Ferret एक डिक्लेरेटिव डेटा ऑटोमेशन भाषा और Go रनटाइम है जिसे स्ट्रक्चर्ड एक्सट्रैक्शन वर्कफ़्लो के लिए बनाया गया है, जो एम्बेडिंग, क्षमता-आधारित एक्सेस और क्रॉस-सोर्स क्वेरीइंग का समर्थन करता है।
ओपन सोर्स। नई संभावनाएँ।
उत्कृष्ट ओपन-सोर्स प्रोजेक्ट खोजें, गुमनाम रूप से प्रोजेक्ट सबमिट करें और अपने प्रोजेक्ट का दावा कर उसे संपादित करें।
जिज्ञासा के साथ ओपन सोर्स खोजें।
THE FIRST COLLECTIONवेबसाइट परिवर्तनों की निगरानी करने और विभिन्न नोटिफिकेशन चैनलों के माध्यम से रीयल-टाइम अलर्ट प्राप्त करने के लिए एक ओपन-सोर्स टूल।
एक AI-संचालित टेम्पलेट जो किसी भी वेबसाइट को एक स्वच्छ Next.js ऐप में सिंगल कमांड से क्लोन करता है। Claude Code, Cursor, Codex, Gemini, और अन्य को सपोर्ट करता है।
web-core एक Python पैकेज है जो साझा वेब इंफ्रास्ट्रक्चर प्रदान करता है: रिट्राय, डुप्लीकेशन और डोमेन फ़िल्टरिंग के साथ SearXNG सर्च; ऑटोमैटिक एस्केलेशन के साथ एक मल्टी-स्ट्रेटजी स्क्रैपिंग एजेंट; DNS पिनिंग के साथ एक SSRF-सुरक्षित HTTP क्लाइंट; स्टील्थ और रिमोट ब्राउज़र रेंडरिंग; और टाइप्ड Google Drive और MangaDex एडेप्टर।
@knownagents/sdk एक Node.js लाइब्रेरी है जो सर्वर‑साइड एप्लिकेशन को AI एजेंट ट्रैफ़िक ट्रैक करने, LLM रेफ़रल रिकॉर्ड करने, अप‑टू‑डेट robots.txt फ़ाइलें जनरेट करने और एजेंट पहचान API के माध्यम से बॉट्स पहचानने में सक्षम बनाता है। यह बैच इवेंट फ्लशिंग, MCP कॉल ट्रैकिंग, और ACP/UCP वाणिज्य प्रवाहों के साथ एकीकरण का समर्थन करता है।
designlang एक Playwright-आधारित CLI है जो किसी वेबसाइट के live DOM से DTCG टोकन, Tailwind config, Figma variables, shadcn theme, component anatomy, motion tokens, brand voice और WCAG contrast audits निकालता है।
Firecrawl एक ओपन-सोर्स वेब डेटा API है जो वेबसाइटों को खोजने, स्क्रैप करने, क्रॉल करने और उनसे इंटरैक्ट करने के लिए है, पेजों को साफ Markdown, JSON या स्क्रीनशॉट में बदलकर AI एजेंट्स और ऐप्स के लिए LLM-ready उपयोग योग्य बनाता है।
Crawlee एक Python वेब स्क्रैपिंग और ब्राउज़र स्वचालन लाइब्रेरी है जो विश्वसनीय क्रॉलर बनाने के लिए है। यह HTTP और हेडलेस ब्राउज़र क्रॉलिंग, स्वचालित रीट्राई, प्रॉक्सी रोटेशन और AI/LLM अनुप्रयोगों के लिए डेटा स्टोरेज का समर्थन करता है।