Huey एक निःशुल्क, ओपन-सोर्स, ब्राउज़र-आधारित स्टेटिक वेब एप्लिकेशन है जो DuckDB-WASM का उपयोग करके डेटा की अन्वेषण एवं विश्लेषण सुविधा प्रदान करता है। यह CSV, Parquet, JSON, XLSX तथा DuckDB फ़ाइलों को स्थानीय ब्राउज़र में ही संसाधित करता है, जिससे डेटा सुरक्षित रहता है।
ओपन सोर्स। नई संभावनाएँ।
उत्कृष्ट ओपन-सोर्स प्रोजेक्ट खोजें, गुमनाम रूप से प्रोजेक्ट सबमिट करें और अपने प्रोजेक्ट का दावा कर उसे संपादित करें।
जिज्ञासा के साथ ओपन सोर्स खोजें।
THE FIRST COLLECTIONFlow एक एकल-बाइनरी, उच्च-प्रदर्शन ETL इंजन और वर्कफ़्लो ऑर्केस्ट्रेटर है जो Go में लिखा गया है। इसमें एक एम्बेडेड विज़ुअल वेब बिल्डर, डिक्लेरेटिव XML पाइपलाइन, क्रॉस-डेटाबेस समर्थन, और अंतर्निहित ऑडिट टेलीमेट्री शामिल है।
Prefect एक Python-आधारित वर्कफ़्लो ऑर्केस्ट्रेशन फ्रेमवर्क है जिसे शेड्यूलिंग और रिट्राइज़ जैसी सुविधाओं के साथ लचीली डेटा पाइपलाइनों के निर्माण, स्वचालन और निगरानी के लिए डिज़ाइन किया गया है।
Made With ML एक ओपन-सोर्स कोर्स और कोडबेस है जो उत्पादन-स्तरीय मशीन लर्निंग एप्लिकेशन्स को डिजाइन, विकसित, डिप्लॉय और इटरेट करने का तरीका सिखाता है, जिसमें MLOps, टेस्टिंग, सर्विंग, CI/CD और कॉन्टिन्यूअल लर्निंग शामिल हैं।
RisingWave एक इवेंट स्ट्रीमिंग प्लेटफॉर्म है जिसे एजेंटिक AI के लिए डिज़ाइन किया गया है, जो डेटा इंजेक्शन, प्रोसेसिंग और सर्विंग को एक ही सिस्टम में एकीकृत करता है।
Redpanda Kafka-संगत ब्रोकर और PySpark Structured Streaming का उपयोग करके एक स्थानीय रियल-टाइम स्ट्रीमिंग एनालिटिक्स पाइपलाइन, clickstream इवेंट की सिम्युलेशन और विंडो-आधारित एग्रीग्रेशन जलवाहीकरण के साथ।
Argo Workflows Kubernetes पर समानांतर जॉब्स को ऑर्केस्ट्रेट करने के लिए एक कंटेनर-नेटिव वर्कफ़्लो इंजन है, जिसे Custom Resource Definition (CRD) के रूप में लागू किया गया है।
Kestra एक ओपन-सोर्स, इवेंट-ड्रिवन ऑर्केस्ट्रेशन प्लेटफॉर्म है जिसे डेटा, AI और इंफ्रास्ट्रक्चर वर्कफ़्लो के लिए डिज़ाइन किया गया है, जो एक डिक्लेरेटिव YAML इंटरफ़ेस का उपयोग करता है।
Taipy एक Python फ्रेमवर्क है जिसे डेटा वैज्ञानिकों और ML इंजीनियरों के लिए डिज़ाइन किया गया है ताकि वे फ्रंट-एंड भाषाएं सीखे बिना प्रोडक्शन-रेडी डेटा और AI-संचालित वेब एप्लिकेशन बना और तैनात कर सकें।
Xonsh एक पावरफुल, क्रॉस-प्लेटफ़ॉर्म शेल है जो Python 3 को अपनी भाषा के रूप में उपयोग करता है। यह Linux, macOS, Windows और अन्य प्लेटफ़ॉर्म पर चलता है। इसमें शेल कमांड्स और Python को सीधे एकीकृत करने की क्षमता है, साथ ही AI इंटीग्रेशन और विस्तारणीय सिस्टम भी उपलब्ध हैं।
SolarisPKN-Stats एक स्वचालित प्रणाली है जो कई प्लेटफार्मों से प्रोजेक्ट आंकड़ों को एकत्र करने, संग्रहीत करने और उन्हें संरचित JSON फाइलों में अपडेट करने का कार्य करती है।
CocoIndex एक ओपन-सोर्स इन्क्रिमेंटल इंडेक्सिंग फ्रेमवर्क है जो AI एजेंट्स और LLM एप्लिकेशन्स को केवल बदले गए डेटा को पुनः प्रोसेस करके लगातार ताज़ा संदर्भ प्रदान करता है।
डेक लैब एक पाइथन/फ्लास्क वर्कस्पेस है जो प्रतिस्पर्धी कमांडर (एमटीजी) डेक्स के लिए निर्माण, अनुसंधान और सिमुलेशन प्रदान करता है।
Great Expectations (GX Core) डेटा गुणवत्ता के लिए एक ओपन-सोर्स Python लाइब्रेरी है, जो डेटा के लिए यूनिट टेस्ट बनाने का एक फ्रेमवर्क प्रदान करती है ताकि निरंतरता और विश्वसनीयता सुनिश्चित की जा सके।
एक डेटा रिसर्च और एनालिसिस प्लेटफॉर्म जो उपयोगकर्ताओं को विज़ुअलाइज़ेशन और विश्लेषण के लिए कस्टम डेटासेट आयात करने में सक्षम बनाता है।
Evidence ड्रैग-एंड-ड्रॉप BI टूल्स का एक ओपन-सोर्स, कोड-आधारित विकल्प है: SQL और markdown के साथ तेज़, इंटरैक्टिव रिपोर्ट बनाएं, फिर जेनरेट की गई स्टैटिक साइट को पब्लिश या सेल्फ-होस्ट करें।
Apache Superset डेटा एक्सप्लोरेशन और विज़ुअलाइज़ेशन के लिए उपयोग किया जाने वाला एक आधुनिक, एंटरप्राइज़-रेडी बिज़नेस इंटेलिजेंस वेब एप्लिकेशन है।
DataPulse मलेशियाई सार्वजनिक डेटा के लिए एक खुला, रीड-ओनली ट्रस्ट और सत्यापन लेयर है। यह 418 आधिकारिक डेटासेट की जांच करता है, उनकी ताजगी, लाइसेंस और उत्पत्ति पर मशीन-रीडेबल साक्ष्य प्रकाशित करता है, और 19-टूल MCP सर्वर के माध्यम से AI एजेंटों को यह कैटलॉग उपलब्ध कराता है।
Dagster एक क्लाउड-नेटिव डेटा पाइपलाइन ऑर्केस्ट्रेटर है जिसे डेटा एसेट्स के पूरे जीवनचक्र के विकास, उत्पादन और अवलोकन के लिए डिज़ाइन किया गया है।
Semantica एक ग्राफ़-नेटिव इंफ्रास्ट्रक्चर है जो AI सिस्टम्स को संरचित संदर्भ, निश्चित तर्क और पूर्ण निर्णय प्रमाण पत्र प्रदान करने के लिए बनाया गया है। यह LLMs और एजेंट्स के लिए एक संव्याख्यान परत के रूप में कार्य करता है।