Sobre o projeto

TextBlob é uma biblioteca Python projetada para processar dados textuais com uma API simples e pitônica. Ela fornece acesso a tarefas comuns de processamento de linguagem natural (PLN), incluindo marcação de classes gramaticais, extração de frases nominais, análise de sentimentos, classificação (Naive Bayes, Árvore de Decisão), tokenização, frequências de palavras e frases, parsing, n-gramas, flexão de palavras (pluralização e singularização), lematização, correção ortográfica e integração com WordNet. A biblioteca se apoia em NLTK e pattern, integrando-se perfeitamente a ambos. Os usuários podem instalá-la via pip e baixar os corpora necessários com um único comando. TextBlob suporta a adição de novos modelos ou idiomas por meio de extensões, tornando-a extensível para diversas necessidades de PLN. Principais recursos incluem: - Extração de frases nominais - Marcação de classes gramaticais - Análise de sentimentos com pontuação de polaridade - Classificação usando algoritmos Naive Bayes e Árvore de Decisão - Tokenização para dividir texto em palavras e frases - Análise de frequência de palavras e frases - Capacidades de parsing - Geração de n-gramas - Flexão e lematização de palavras - Correção ortográfica - Integração com WordNet TextBlob é licenciado sob MIT e está disponível no PyPI. A documentação completa está disponível em textblob.readthedocs.io.