इस प्रोजेक्ट के बारे में
Instructor एक Python लाइब्रेरी है जो लार्ज लैंग्वेज मॉडल्स (LLMs) से संरचित डेटा निकालना सरल बनाने के लिए डिज़ाइन की गई है। यह Pydantic के साथ इंटीग्रेट होती है ताकि मैन्युअल JSON पार्सिंग या एरर हैंडलिंग के बिना टाइप-सेफ, वैध आउटपुट मिल सके। डेवलपर्स इच्छित आउटपुट संरचना का प्रतिनिधित्व करने वाला एक Pydantic मॉडल परिभाषित करते हैं, फिर इसे Instructor के क्लाइंट इंटरफ़ेस को पास करते हैं, जो स्वचालित रूप से स्कीमा जनरेशन, रिस्पॉन्स वैलिडेशन, और यदि वैलिडेशन विफल हो तो रीट्राई लॉजिक को हैंडल करता है।
यह लाइब्रेरी OpenAI, Anthropic, Google Gemini, Ollama, और Groq सहित कई LLM प्रदाताओं का समर्थन करती है — सभी एक सुसंगत API के माध्यम से। इसमें उत्पत्ति के दौरान आंशिक परिणाम स्ट्रीमिंग, नेस्टेड ऑब्जेक्ट एक्सट्रैक्शन, और अमान्य आउटपुट के लिए फीडबैक के साथ स्वचालित रीट्राई जैसे उन्नत सुविधाएं भी उपलब्ध हैं।
LangChain या LlamaIndex जैसे फ्रेमवर्क्स की तुलना में Instructor हल्का है और केवल संरचित एक्सट्रैक्शन पर केंद्रित है। इसका उपयोग OpenAI, Google, Microsoft, और AWS की टीमों सहित 100,000 से अधिक डेवलपर्स और कंपनियाँ उत्पादन में कर रही हैं। इस प्रोजेक्ट के GitHub पर 10K से अधिक स्टार्स और मासिक 3M+ डाउनलोड हैं।
Python के परे, Instructor को TypeScript, Ruby, Go, Elixir, और Rust में आधिकारिक कार्यान्वयन उपलब्ध हैं। दस्तावेज़ीकरण, उदाहरण, और Discord सर्वर के माध्यम से कॉम्युनिटी सपोर्ट उपलब्ध है। अधिक जटिल एजेंट वर्कफ़्लो के लिए, टीम PydanticAI की सिफारिश करती है, जो Instructor के आधार पर अतिरिक्त टूलिंग और ओब्सर्वेबिलिटी सुविधाओं के साथ निर्मित है।
स्थापना pip, uv, या Poetry के माध्यम से सीधी है। किसी जटिल सेटअप की आवश्यकता नहीं — बस अपना मॉडल परिभाषित करें और प्राकृतिक भाषा इनपुट से संरचित डेटा को विश्वसनीय रूप से निकालें।
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.