Ultralytics YOLOv5 एक लोकप्रिय ओपन-सोर्स कंप्यूटर विज़न फ्रेमवर्क है जो PyTorch पर बना है। यह ऑब्जेक्ट डिटेक्शन, इंस्टेंस सेगमेंटेशन और इमेज क्लासिफिकेशन के लिए प्रीट्रेन्ड और ट्रेनेबल मॉडल प्रदान करता है।
ओपन सोर्स। नई संभावनाएँ।
उत्कृष्ट ओपन-सोर्स प्रोजेक्ट खोजें, गुमनाम रूप से प्रोजेक्ट सबमिट करें और अपने प्रोजेक्ट का दावा कर उसे संपादित करें।
जिज्ञासा के साथ ओपन सोर्स खोजें।
THE FIRST COLLECTIONColossal-AI एक ओपन-सोर्स सिस्टम है जो बड़े AI मॉडल को प्रशिक्षण और चलाने के लिए अधिक सस्ता और कुशल बनाता है, LLMs, डिफ्यूजन मॉडल और अन्य के लिए समानांतर प्रशिक्षण रणनीतियाँ, मेमोरी प्रबंधन और निष्कर्षण त्वरण प्रदान करता है।
vLLM एक उच्च-थ्रूपुट और मेमोरी-कुशल लाइब्रेरी है जिसे Large Language Model (LLM) इन्फरेंस और सर्विंग के लिए डिज़ाइन किया गया है।
Mithril एक बहु-मॉडल ऑर्केस्ट्रेशन इंजन है जो Gemini, OpenAI, Anthropic, Groq और स्थानीय GGUF मॉडलों को एक ही Ollama-संगत API के पीछे एकीकृत करता है। YAML में मल्टी-एजेंट टीमों को कॉन्फ़िगर करें, जिसमें 24 अंतर्निहित टूल, Docker समर्थन और MCP एकीकरण शामिल हैं।
OpenAI के Whisper ऑटोमैटिक स्पीच रिकग्निशन (ASR) मॉडल के लिए एक उच्च-प्रदर्शन C/C++ कार्यान्वयन, जिसे हल्के और क्रॉस-प्लेटफॉर्म परिनियोजन के लिए डिज़ाइन किया गया है।
Oumi एक ओपन-सोर्स प्लेटफ़ॉर्म है जो फाउंडेशन-मॉडल के पूरे जीवनचक्र को कवर करता है: डेटा तैयारी, प्रशिक्षण और फाइन-ट्यूनिंग (SFT, LoRA, QLoRA, GRPO), मूल्यांकन, LLM जज के साथ डेटा संश्लेषण, और vLLM/SGLang के माध्यम से तैनाती, साथ में CLI और क्लाउड जॉब लॉन्चिंग।
Xinference एक एकीकृत इन्फरेंस लाइब्रेरी है जो भाषा, वाक् और मल्टीमॉडल मॉडल की सेवा के लिए है। यह OpenAI-संगत RESTful API, विषम GPU/CPU उपयोग, वितरित तैनाती प्रदान करता है और LangChain, LlamaIndex, Dify तथा Chatbox के साथ एकीकृत होता है।
CTranslate2 का उपयोग करके OpenAI के Whisper मॉडल का एक तेज़ पुन: कार्यान्वयन, जो बेहतर ट्रांसक्रिप्शन गति और कम मेमोरी उपयोग प्रदान करता है।
DeepSpeed एक डीप लर्निंग ऑप्टिमाइज़ेशन लाइब्रेरी है जिसे बड़े पैमाने के मॉडलों के प्रशिक्षण और अनुमान (inference) को आसान, कुशल और प्रभावी बनाने के लिए डिज़ाइन किया गया है।
RunAnywhere एक क्रॉस-प्लेटफॉर्म SDK सूट है जो फोन, ब्राउज़र, डेस्कटॉप और सर्वर पर पूरी तरह से ऑन-डिवाइस AI मॉडल चलाने के लिए है। यह LLM, विजन, स्पीच, वॉयस एजेंट, RAG, एम्बेडिंग और इमेज जनरेशन को एक ही सेमैंटिक API के साथ सपोर्ट करता है।
SGLang बड़े भाषा मॉडल (LLMs) और मल्टीमॉडल मॉडल के लिए एक उच्च-प्रदर्शन सर्विंग फ्रेमवर्क है, जिसे कम विलंबता और उच्च थ्रूपुट इन्फरेंस के लिए डिज़ाइन किया गया है।
jetson-inference एक NVIDIA Jetson के लिए C++ और Python डीप-विज़न लाइब्रेरी है। यह TensorRT का उपयोग डिवाइस पर इंफ़रेंस के लिए और PyTorch का प्रशिक्षण के लिए करती है, जिसमें वर्गीकरण, डिटेक्शन, सेगमेंटेशन, पोज़, एक्शन, डेप्थ और कैमरा स्ट्रीमिंग के उदाहरण, पूर्व-प्रशिक्षित मॉडल और ट्यूटोरियल शामिल हैं।
MediaPipe Google का एक क्रॉस-प्लेटफॉर्म फ्रेमवर्क और लाइव व स्ट्रीमिंग मीडिया के लिए ऑन-डिवाइस मशीन लर्निंग समाधानों का सूट है, जो Android, iOS, वेब, डेस्कटॉप और एज डिवाइस पर विजन, टेक्स्ट और ऑडियो कार्यों को कवर करता है।