@knownagents/sdk एक Node.js लाइब्रेरी है जो सर्वर‑साइड एप्लिकेशन को AI एजेंट ट्रैफ़िक ट्रैक करने, LLM रेफ़रल रिकॉर्ड करने, अप‑टू‑डेट robots.txt फ़ाइलें जनरेट करने और एजेंट पहचान API के माध्यम से बॉट्स पहचानने में सक्षम बनाता है। यह बैच इवेंट फ्लशिंग, MCP कॉल ट्रैकिंग, और ACP/UCP वाणिज्य प्रवाहों के साथ एकीकरण का समर्थन करता है।
ओपन सोर्स। नई संभावनाएँ।
उत्कृष्ट ओपन-सोर्स प्रोजेक्ट खोजें, गुमनाम रूप से प्रोजेक्ट सबमिट करें और अपने प्रोजेक्ट का दावा कर उसे संपादित करें।
जिज्ञासा के साथ ओपन सोर्स खोजें।
THE FIRST COLLECTIONDouyin और TikTok के लिए एक स्व-होस्टेड डेटा API। यह पोस्ट, प्रोफ़ाइल, कमेंट्स और प्लेलिस्ट प्राप्त करता है, और वीडियो व इमेज एल्बम बिना वॉटरमार्क के डाउनलोड करता है। इसमें सेल्फ-हीलिंग आइडेंटिटी पूल, PostgreSQL आर्काइविंग, REST API, MCP सर्वर, CLI और वेब कंसोल शामिल हैं।
Skill Seekers एक CLI टूल है जो दस्तावेज़ों, GitHub रिपोजिटरीज़, PDFs, वीडियो और अन्य स्रोतों को AI स्किल्स में बदलता है। यह Claude, Gemini, OpenAI सहित 22 निर्यात लक्ष्यों का समर्थन करता है।
designlang एक Playwright-आधारित CLI है जो किसी वेबसाइट के live DOM से DTCG टोकन, Tailwind config, Figma variables, shadcn theme, component anatomy, motion tokens, brand voice और WCAG contrast audits निकालता है।
Scrapy एक तेज़, उच्च-स्तरीय वेब स्क्रैपिंग फ्रेमवर्क है जो Python के लिए बनाया गया है। यह क्रॉस-प्लेटफ़ॉर्म है और इसके लिए Python 3.10 या उससे नए संस्करण की आवश्यकता होती है। इसका रखरखाव Zyte और अन्य योगदानकर्ता करते हैं।
पायथन के लिए अनुकूली वेब स्क्रैपिंग फ्रेमवर्क: बुद्धिमान DOM ट्रैकिंग, एंटी-बॉट बायपास फेचर, पॉज़/रिज़्यूम के साथ समवर्ती क्रॉलिंग, प्रॉक्सी रोटेशन, और MCP/AI-तैयार आउटपुट।
Firecrawl एक ओपन-सोर्स वेब डेटा API है जो वेबसाइटों को खोजने, स्क्रैप करने, क्रॉल करने और उनसे इंटरैक्ट करने के लिए है, पेजों को साफ Markdown, JSON या स्क्रीनशॉट में बदलकर AI एजेंट्स और ऐप्स के लिए LLM-ready उपयोग योग्य बनाता है।
Crawlee एक Python वेब स्क्रैपिंग और ब्राउज़र स्वचालन लाइब्रेरी है जो विश्वसनीय क्रॉलर बनाने के लिए है। यह HTTP और हेडलेस ब्राउज़र क्रॉलिंग, स्वचालित रीट्राई, प्रॉक्सी रोटेशन और AI/LLM अनुप्रयोगों के लिए डेटा स्टोरेज का समर्थन करता है।
Ferret एक डिक्लेरेटिव डेटा ऑटोमेशन भाषा और Go रनटाइम है जिसे स्ट्रक्चर्ड एक्सट्रैक्शन वर्कफ़्लो के लिए बनाया गया है, जो एम्बेडिंग, क्षमता-आधारित एक्सेस और क्रॉस-सोर्स क्वेरीइंग का समर्थन करता है।
GitHub Actions पर चलने वाली स्वचालित नौकरी अलर्ट पाइपलाइन, जो 6 मुख्य कंपनी कैरियर API और लगभग 1200 ATS नौकरी पोर्टलों को जांचती है, अमेरिका आधारित प्रवेश और मध्यम स्तरीय सॉफ्टवेयर इंजीनियरिंग भूमिकाओं के लिए फ़िल्टर करती है और गैर-स्पॉन्सर्ड, इंटर्नशिप, QA, मार्केटिंग आदि को छोड़ती है।
एक व्यक्तिगत ऑटोमेशन जो Playwright ब्राउज़र-ऑटोमेशन और डायरेक्ट API कॉल का उपयोग करके जिम क्लास बुकिंग विंडो खुलते ही बुकिंग करता है, साथ ही GitHub Pages डैशबोर्ड के लिए शेड्यूल स्क्रैपर का उपयोग करता है।
वेबसाइट परिवर्तनों की निगरानी करने और विभिन्न नोटिफिकेशन चैनलों के माध्यम से रीयल-टाइम अलर्ट प्राप्त करने के लिए एक ओपन-सोर्स टूल।
J.A.R.V.I.S एक स्थानीय-प्रथम OSINT प्लेटफ़ॉर्म है जो AI और वेब स्क्रैपिंग का उपयोग करके व्यक्तियों पर व्यापक खुफिया डोजियर बनाता है, जबकि डेटा गोपनीयता सुनिश्चित करता है।
i2iFunding P2P लेंडिंग मार्केटप्लेस के लिए एक पायथन टूल जो हर कुछ मिनटों में स्क्रेप करता है, ऋणों को यील्ड और क्रेडिट के आधार पर स्कोर करता है, टेलीग्राम/ntfy अलर्ट भेजता है, और कमिट की गई JSON फ़ाइलों से संचालित GitHub Pages डैशबोर्ड प्रस्तुत करता है। एक विकल्पित, सुरक्षित स्वचालित निवेशक वास्तविक निवेश रख सकता है।
एक AI-संचालित टेम्पलेट जो किसी भी वेबसाइट को एक स्वच्छ Next.js ऐप में सिंगल कमांड से क्लोन करता है। Claude Code, Cursor, Codex, Gemini, और अन्य को सपोर्ट करता है।
web-core एक Python पैकेज है जो साझा वेब इंफ्रास्ट्रक्चर प्रदान करता है: रिट्राय, डुप्लीकेशन और डोमेन फ़िल्टरिंग के साथ SearXNG सर्च; ऑटोमैटिक एस्केलेशन के साथ एक मल्टी-स्ट्रेटजी स्क्रैपिंग एजेंट; DNS पिनिंग के साथ एक SSRF-सुरक्षित HTTP क्लाइंट; स्टील्थ और रिमोट ब्राउज़र रेंडरिंग; और टाइप्ड Google Drive और MangaDex एडेप्टर।