इस प्रोजेक्ट के बारे में

GPT Researcher एक ओपन-सोर्स ऑटोनॉमस रिसर्च एजेंट है जिसे वेब और स्थानीय दस्तावेज़ स्रोतों दोनों का लाभ उठाकर किसी भी दिए गए विषय पर गहन जांच करने के लिए डिज़ाइन किया गया है। यह व्यापक, तथ्यात्मक और उद्धरण-समर्थित शोध रिपोर्ट तैयार करता है, जिसका उद्देश्य समानांतर एजेंट कार्य और कई स्रोतों के एकत्रीकरण के माध्यम से गलत सूचना और पूर्वाग्रह को कम करना है। यह सिस्टम एक planner-executor-publisher आर्किटेक्चर का पालन करता है: planner शोध प्रश्नों को तैयार करता है, execution एजेंट वेब स्क्रैपिंग (JavaScript-सक्षम क्रॉलिंग सहित) और स्थानीय फ़ाइल पार्सिंग (PDF, Word, Excel, आदि) के माध्यम से डेटा एकत्र करते हैं, और publisher निष्कर्षों को 2,000 शब्दों से अधिक की संरचित रिपोर्टों में संकलित करता है। मुख्य विशेषताओं में Google Gemini मॉडल का उपयोग करके AI-जनरेटेड इनलाइन इमेज, प्रति रिपोर्ट 20 से अधिक एकत्रित स्रोतों का समर्थन, PDF/Word प्रारूपों में निर्यात, और ऑब्जर्वेबिलिटी के लिए LangSmith या Monocle के साथ वैकल्पिक एकीकरण शामिल हैं। इसे Python पैकेज, Docker कंटेनर, या Claude Skill के रूप में इंस्टॉल किया जा सकता है, जिससे कन्वर्सेशनल AI इंटरफेस के भीतर सहज उपयोग संभव होता है। उन्नत क्षमताओं में Deep Research — एक रिकर्सिव, ट्री-आधारित एक्सप्लोरेशन वर्कफ़्लो — और LangGraph और AG2 के साथ निर्मित Multi-Agent Assistant फ्रेमवर्क शामिल हैं, जो STORM पद्धति से प्रेरित हैं। उपयोगकर्ता रिट्रीवल विधियों को कस्टमाइज़ कर सकते हैं (जैसे GitHub/डेटाबेस एक्सेस के लिए Tavily + MCP), DOC_PATH के माध्यम से स्थानीय दस्तावेज़ शोध सक्षम कर सकते हैं, और फ्रंटएंड विकल्प (लाइटवेट FastAPI या प्रोडक्शन-ग्रेड NextJS) कॉन्फ़िगर कर सकते हैं। यह प्रोजेक्ट Apache 2 लाइसेंस के तहत पारदर्शिता, सामुदायिक सहयोग और शैक्षणिक प्रयोग पर जोर देता है, जबकि अपनी प्रयोगात्मक प्रकृति और पूर्ण वस्तुनिष्ठता के संबंध में सीमाओं को स्वीकार करता है।