Sobre o projeto
TextBlob é uma biblioteca Python projetada para processar dados textuais com uma API simples e pitônica. Ela fornece acesso a tarefas comuns de processamento de linguagem natural (PLN), incluindo marcação de classes gramaticais, extração de frases nominais, análise de sentimentos, classificação (Naive Bayes, Árvore de Decisão), tokenização, frequências de palavras e frases, parsing, n-gramas, flexão de palavras (pluralização e singularização), lematização, correção ortográfica e integração com WordNet.
A biblioteca se apoia em NLTK e pattern, integrando-se perfeitamente a ambos. Os usuários podem instalá-la via pip e baixar os corpora necessários com um único comando. TextBlob suporta a adição de novos modelos ou idiomas por meio de extensões, tornando-a extensível para diversas necessidades de PLN.
Principais recursos incluem:
- Extração de frases nominais
- Marcação de classes gramaticais
- Análise de sentimentos com pontuação de polaridade
- Classificação usando algoritmos Naive Bayes e Árvore de Decisão
- Tokenização para dividir texto em palavras e frases
- Análise de frequência de palavras e frases
- Capacidades de parsing
- Geração de n-gramas
- Flexão e lematização de palavras
- Correção ortográfica
- Integração com WordNet
TextBlob é licenciado sob MIT e está disponível no PyPI. A documentação completa está disponível em textblob.readthedocs.io.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.