इस प्रोजेक्ट के बारे में

TextBlob पाठ डेटा को संसाधित करने के लिए डिज़ाइन की गई एक पायथन लाइब्रेरी है, जिसमें एक सरल और पायथनिक API शामिल है। यह सामान्य प्राकृतिक भाषा प्रसंस्करण (NLP) कार्यों तक पहुंच प्रदान करता है, जिसमें शब्द-प्रकार टैगिंग (POS), नामवाचक वाक्यांश निष्कर्षण, भाव विश्लेषण, वर्गीकरण (नेवे बायेस और निर्णय वृक्ष), टोकनाइजेशन, शब्द और वाक्यांश आवृत्तियाँ, व्याकरण विश्लेषण, एन-ग्राम, शब्द विभक्ति (बहुवचन और एकवचन), लेमाटाइजेशन, वर्तनी सुधार और WordNet एकीकरण शामिल हैं। यह लाइब्रेरी NLTK और pattern के सहारे खड़ी है और दोनों के साथ सहजता से एकीकृत होती है। उपयोगकर्ता pip के माध्यम से इसे स्थापित कर सकते हैं और एक ही कमांड के साथ आवश्यक कॉर्पोरा डाउनलोड कर सकते हैं। TextBlob एक्सटेंशन के माध्यम से नए मॉडल या भाषाओं को जोड़ने का समर्थन करता है, जिससे यह विभिन्न NLP आवश्यकताओं के लिए विस्तारणीय बन जाता है। मुख्य विशेषताएं: - नामवाचक वाक्यांश निष्कर्षण - शब्द-प्रकार टैगिंग - ध्रुवीयता स्कोरिंग के साथ भाव विश्लेषण - नेवे बायेस और निर्णय वृक्ष एल्गोरिदम का उपयोग करके वर्गीकरण - पाठ को शब्दों और वाक्यों में विभाजित करने के लिए टोकनाइजेशन - शब्द और वाक्यांश आवृत्ति विश्लेषण - व्याकरण विश्लेषण क्षमताएं - एन-ग्राम जनरेशन - शब्द विभक्ति और लेमाटाइजेशन - वर्तनी सुधार - WordNet एकीकरण TextBlob MIT लाइसेंस के तहत उपलब्ध है और PyPI पर मौजूद है। पूर्ण दस्तावेज़ textblob.readthedocs.io पर उपलब्ध है।