Sobre o projeto

txtai é um framework abrangente de IA projetado para construir aplicações de busca semântica, orquestração de LLMs e fluxos de trabalho complexos de modelos de linguagem. No seu núcleo está um banco de dados de embeddings que integra índices vetoriais (sparse e dense), redes graph, e bancos de dados relacionais, fornecendo uma base para busca vetorial e fontes de conhecimento para aplicações de Large Language Model (LLM). Principais capacidades incluem: - Busca Vetorial: Suporta SQL, object storage, modelagem de tópicos, análise graph e indexação multimodal para texto, documentos, áudio, imagens e vídeo. - Orquestração de LLMs: Ferramentas para construir agentes autônomos, processos de Retrieval Augmented Generation (RAG) e fluxos de trabalho multi-modelo. - Pipelines e Workflows: Pipelines pré-construídos para tarefas como question-answering, labeling, transcrição, tradução e summarization, que podem ser combinados em fluxos de trabalho maiores de lógica de negócios. - Agents: Agentes inteligentes construídos sobre o framework smolagents que conectam embeddings e pipelines para resolver problemas complexos. - API e Integração: Fornece APIs Web e Model Context Protocol (MCP) com bindings para JavaScript, Java, Rust e Go. É construído usando Python 3.10+, Hugging Face Transformers, Sentence Transformers e FastAPI.