इस प्रोजेक्ट के बारे में
Kotlin DataFrame एक ओपन-सोर्स जेटब्रेन्स इनक्यूबेटर प्रोजेक्ट (बीटा स्थिरता) है जो JVM पर टेबुलर डेटा की टाइप-सुरक्षित, इन-मेमोरी प्रोसेसिंग प्रदान करता है। इसका उद्देश्य Kotlin की स्थिर टाइपिंग को डेटा की गतिशील प्रकृति के साथ समेटना है, एक इंटरैक्टिव कंपाइलर प्लगइन का उपयोग करके जो कंपाइल समय पर संरचना परिवर्तनों का मूल्यांकन करता है ताकि कॉलम तक टाइप-सुरक्षित पहुंच मिल सके।
README में वर्णित प्रमुख विशेषताएँ:
- पदानुक्रमित: JSON या JVM ऑब्जेक्ट्स के पेड़ जैसी पदानुक्रमित संरचनाओं का प्रतिनिधित्व करता है।
- कार्यात्मक: प्रोसेसिंग पाइपलाइन DataFrame परिवर्तन संचालन की श्रृंखलाएँ हैं।
- अपरिवर्तनीय: प्रत्येक ऑपरेशन एक नया DataFrame लौटाता है, जहाँ संभव हो अंतर्निहित स्टोरेज का पुन: उपयोग करता है।
- पठनीय: परिवर्तन प्राकृतिक भाषा के करीब एक DSL में व्यक्त किए जाते हैं।
- व्यावहारिक: सामान्य समस्याओं के लिए सरल समाधान और जटिल कार्यों के लिए समर्थन।
- इंटरऑपरेबल: Kotlin डेटा क्लासेस और कलेक्शन के साथ परिवर्तनीय, जो अन्य लाइब्रेरीज़ की संरचनाओं में और उनसे रूपांतरण को आसान बनाता है।
- जेनेरिक: केवल संख्याओं या स्ट्रिंग्स के अलावा किसी भी प्रकार की वस्तुओं को संग्रहीत कर सकता है।
- टाइपसेफ: नल-सुरक्षा के साथ टाइप-सुरक्षित पहुंच के लिए एक्सटेंशन प्रॉपर्टीज की ऑन-द-फ्लाई जनरेशन।
- बहुरूपी: प्रकार संगतता कॉलम स्कीमा संगतता से प्राप्त होती है; फ़ंक्शन कॉलम के एक सबसेट की आवश्यकता कर सकते हैं।
यह Kotlin Jupyter Kernel (Datalore, Jupyter Notebook) का उपयोग करके Kotlin Notebook और अन्य वातावरणों के साथ `%use dataframe` लाइन मैजिक के माध्यम से एकीकृत होता है। परियोजना krangl, Kotlin Collections और pandas से प्रेरणा लेती है।
दस्तावेज़ीकरण में एक क्विकस्टार्ट गाइड, सेटअप, डेटा स्कीमा, कंपाइलर प्लगइन कॉन्फ़िगरेशन, और समर्थित संचालन की पूरी सूची शामिल है, जिसमें SQL डेटाबेस से पढ़ना, JSON, CSV और Apache Arrow पढ़ना/लिखना, डेटाफ्रेम जोड़ना, groupBy, और HTML में रेंडर करना शामिल है। विज़ुअलाइज़ेशन अलग Kandy प्लॉटिंग लाइब्रेरी द्वारा प्रदान किया जाता है।
सेटअप निर्देश Gradle, Maven और Kotlin Toolchain के लिए दिए गए हैं, जिसमें Maven Central से `org.jetbrains.kotlinx:dataframe:1.0.0-rc01` जैसे निर्भरता निर्देशांक शामिल हैं, साथ ही कंपाइलर प्लगइन को कॉन्फ़िगर करने के नोट्स भी हैं। एक संगतता तालिका लाइब्रेरी संस्करणों को न्यूनतम Java संस्करणों, Kotlin संस्करणों, Kotlin Jupyter संस्करणों, Apache Arrow संस्करणों, कंपाइलर प्लगइन संस्करणों और संगत Kandy संस्करणों से मैप करती है।
एक कोड उदाहरण CSV फ़ाइल पढ़ना, टाइप किए गए स्कीमा में परिवर्तित करना, कॉलम का नाम बदलना, कॉलम मान द्वारा फ़िल्टर करना, स्ट्रिंग कॉलम को सूची में परिवर्तित करना, गणना किया गया कॉलम जोड़ना, और परिणाम को वापस CSV में लिखना दिखाता है।
परियोजना Apache 2.0 के तहत लाइसेंस प्राप्त है और जेटब्रेन्स ओपन सोर्स और कम्युनिटी कोड ऑफ कंडक्ट द्वारा शासित है।
Comments
0 people shared their preference · Deer Point appears after 10 participants
Sign in to join the discussion.