LEANN é um banco de dados vetorial leve para RAG pessoal, reduzindo armazenamento em até 97% por meio de recomputação seletiva baseada em grafos.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONPixelRAG é um sistema RAG visual de código aberto que converte documentos em screenshots para preservar tabelas e gráficos. Oferece indexação hospedada da Wikipedia, ferramentas CLI, integração com Claude Code e suporte local via CUDA/MPS.
CocoIndex é um framework de indexação incremental de código aberto projetado para fornecer contextos continuamente atualizados para agentes de IA e aplicações LLM, reprocesando apenas dados modificados.
TalaDB é um banco de dados de vetores e documentos embarcado projetado para IA no dispositivo, fornecendo uma API TypeScript unificada para Browser, Node.js e React Native.
DB-GPT é um assistente de dados de IA agêntica de código aberto que se conecta a bancos de dados, planilhas e bases de conhecimento, escreve autonomamente código SQL e Python, executa habilidades reutilizáveis em ambientes isolados e transforma análises em gráficos, painéis e relatórios.
HelixDB é um banco de dados OLTP de grafo-vetor construído em Rust sobre armazenamento de objetos, projetado para grafos de conhecimento e memória de IA.
LightRAG é um framework leve de geração aumentada por recuperação (RAG) baseado em grafos de conhecimento, do HKUDS, com recuperação em dois níveis, indexação em grafo, parsing multimodal, múltiplos backends de armazenamento e servidor API com WebUI.
Um framework de IA tudo-em-um para busca semântica, orquestração de LLMs e fluxos de trabalho de modelos de linguagem.
SYNAPSE é uma plataforma de agregação de inteligência e automação impulsionada por IA, apresentando um sistema multiagente e capacidades de RAG para pesquisa e geração de documentos.
Deep Lake é um banco de dados serverless multimodal para IA que combina busca vetorial com armazenamento de embeddings, imagens, vídeo, áudio e documentos. Ele transmite dados diretamente do armazenamento em nuvem para PyTorch/TensorFlow, suporta versionamento e integra-se com LangChain, LlamaIndex e Weights & Biases.
PageIndex é um motor RAG vetorial-less baseado em raciocínio que constrói índices em árvore hierárquica para documentos longos e permite que um LLM raciocine sobre a árvore para recuperar seções relevantes, evitando bancos de vetores e chunking.
SDK Python para a API AskNews que injeta contexto de notícias em tempo real em qualquer LLM com uma única linha de código, oferecendo endpoints para busca de notícias, rastreamento de eventos, previsões, análises, pesquisa profunda, grafos de conhecimento e busca na web.