عن المشروع
TextBlob هي مكتبة بايثون مصممة لمعالجة البيانات النصية بواجهة برمجية بسيطة وبتعامل بايثوني. توفر إمكانية الوصول إلى مهام معالجة اللغة الطبيعية الشائعة بما في ذلك وضع علامات أجزاء الكلام، واستخراج العبارات الاسمية، وتحليل المشاعر، والتصنيف (Naive Bayes، Decision Tree)، والتقطيع، وترددات الكلمات والعبارات، والتحليل النحوي، وn-grams، وتصريف الكلمات (الجمع والمفرد)، والاشتقاق، وتصحيح الإملاء، وتكامل WordNet.
تعتمد المكتبة على NLTK وpattern، وتتكامل معهما بسلاسة. يمكن للمستخدمين تثبيتها عبر pip وتنزيل المجموعات النصية المطلوبة بأمر واحد. تدعم TextBlob إضافة نماذج أو لغات جديدة من خلال الامتدادات، مما يجعلها قابلة للتوسع لمختلف احتياجات معالجة اللغة.
تشمل الميزات الرئيسية:
- استخراج العبارات الاسمية
- وضع علامات أجزاء الكلام
- تحليل المشاعر مع تسجيل القطبية
- التصنيف باستخدام خوارزميات Naive Bayes وDecision Tree
- التقطيع لتقسيم النص إلى كلمات وجمل
- تحليل تردد الكلمات والعبارات
- قدرات التحليل النحوي
- توليد n-grams
- تصريف الكلمات والاشتقاق
- تصحيح الإملاء
- تكامل WordNet
TextBlob مرخصة بموجب MIT ومتاحة على PyPI. الوثائق الكاملة متاحة على textblob.readthedocs.io.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.