프로젝트 소개

TextBlob은 간단하고 Pythonic한 API로 텍스트 데이터를 처리하도록 설계된 Python 라이브러리입니다. 품사 태깅, 명사구 추출, 감정 분석, 분류(나이브 베이즈, 결정 트리), 토큰화, 단어 및 구 빈도, 구문 분석, n-gram, 단어 굴절(복수화 및 단수화), 표제어 추출, 맞춤법 교정, WordNet 통합 등 일반적인 자연어 처리(NLP) 작업에 대한 접근을 제공합니다. 이 라이브러리는 NLTK와 pattern을 기반으로 하여 두 가지와 원활하게 통합됩니다. 사용자는 pip를 통해 설치하고 단일 명령으로 필요한 코퍼스를 다운로드할 수 있습니다. TextBlob은 확장을 통해 새로운 모델이나 언어를 추가할 수 있어 다양한 NLP 요구에 맞게 확장 가능합니다. 주요 기능은 다음과 같습니다: - 명사구 추출 - 품사 태깅 - 극성 점수를 사용한 감정 분석 - 나이브 베이즈 및 결정 트리 알고리즘을 사용한 분류 - 텍스트를 단어와 문장으로 분할하는 토큰화 - 단어 및 구 빈도 분석 - 구문 분석 기능 - N-gram 생성 - 단어 굴절 및 표제어 추출 - 맞춤법 교정 - WordNet 통합 TextBlob은 MIT 라이선스로 제공되며 PyPI에서 사용할 수 있습니다. 전체 문서는 textblob.readthedocs.io에서 확인할 수 있습니다.