Apache Doris आधिकारिक वेबसाइट (doris.apache.org) का स्रोत कोड, Docusaurus 3 के साथ बनाया गया। यह Apache Doris के लिए बहुभाषी दस्तावेज़ीकरण, ब्लॉग पोस्ट और सामुदायिक गाइड होस्ट करता है, जो एक वास्तविक समय MPP विश्लेषणात्मक डेटाबेस है।
ओपन सोर्स। नई संभावनाएँ।
उत्कृष्ट ओपन-सोर्स प्रोजेक्ट खोजें, गुमनाम रूप से प्रोजेक्ट सबमिट करें और अपने प्रोजेक्ट का दावा कर उसे संपादित करें।
जिज्ञासा के साथ ओपन सोर्स खोजें।
THE FIRST COLLECTIONApache Spark बड़े पैमाने पर डेटा प्रोसेसिंग के लिए डिज़ाइन किया गया एक एकीकृत एनालिटिक्स इंजन है, जो सामान्य कंप्यूटेशन ग्राफ के लिए उच्च-स्तरीय API और एक अनुकूलित इंजन प्रदान करता है।
Apache Flink एक ओपन-सोर्स स्ट्रीम प्रोसेसिंग फ्रेमवर्क है जो डेटा स्ट्रीमिंग और बैच प्रोसेसिंग दोनों के लिए शक्तिशाली क्षमताएं प्रदान करता है।
Apache Beam बैच और स्ट्रीमिंग डेटा-पैरेलल प्रोसेसिंग पाइपलाइनों को परिभाषित करने के लिए एक एकीकृत प्रोग्रामिंग मॉडल है।
डेल्टा लेक एक ओपन-सोर्स स्टोरेज फ्रेमवर्क है जो लेकहाउस आर्िटेक्चर को सक्षम बनाता है। यह Spark, PrestoDB, Flink, Trino और Hive जैसे कंप्यूट इंजनों के साथ एकीकृत होता है, और विश्वसनीय डेटा प्रबंधन के लिए ACID ट्रांजैक्शन, टाइम ट्रैवल और स्कीमा इवोल्यूशन प्रदान करता है।
Arkime एक बड़े पैमाने का, ओपन-सोर्स नेटवर्क विश्लेषण और पैकेट कैप्चर सिस्टम है जो PCAP फॉर्मेट में नेटवर्क ट्रैफिक को स्टोर और इंडेक्स करता है।
Trino बिग डेटा एनालिटिक्स के लिए डिज़ाइन किया गया एक तेज़ वितरित SQL क्वेरी इंजन है, जिसे पहले PrestoSQL के नाम से जाना जाता था।
CatBoost, Yandex का ओपन-सोर्स ग्रेडिएंट बुस्टिंग लाइब्रेरी है, जो वर्गीकरण, प्रतिगमन और रैंकिंग के लिए है। इसमें मूल श्रेणीगत सुविधा समर्थन, CPU/GPU प्रशिक्षण, Apache Spark के माध्यम से वितरित प्रशिक्षण और Python, R, Java और C++ के लिए API शामिल हैं।
स्केलेबल, विश्वसनीय और उच्च-प्रदर्शन वाले बड़े पैमाने के सिस्टम बनाने पर क्यूरेटेड रीडिंग लिस्ट, जिसमें डिज़ाइन सिद्धांत, टेक दिग्गजों के केस स्टडीज़ और इंटरव्यू संसाधन शामिल हैं।
Apache DataFusion Rust में लिखा गया एक विस्तार योग्य क्वेरी इंजन है जो इन-मेमोरी फॉर्मेट के रूप में Apache Arrow का उपयोग करता है, और तेज़ एनालिटिक सिस्टम बनाने के लिए SQL और DataFrame APIs प्रदान करता है।
ClickHouse एक ओपन-सोर्स, कॉलम-ओरिएंटेड डेटाबेस मैनेजमेंट सिस्टम है जिसे रियल-टाइम एनालिटिकल डेटा रिपोर्टिंग के लिए डिज़ाइन किया गया है।
साइथॉन एक ऑप्टिमाइज़िंग पायथन कंपाइलर है जो पायथन कोड को सी/सी++ में बदलकर कुशल एक्सटेंशन बनाता है।