ParadeDB es una extensión de Postgres que integra la búsqueda de texto completo, la recuperación de vectores y la analítica en una sola base de datos.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONLEANN es una base de datos vectorial ligera diseñada para aplicaciones RAG personales, que reduce los requisitos de almacenamiento hasta un 97% mediante recomputación selectiva basada en grafos.
TalaDB es una base de datos de vectores y documentos embebida diseñada para IA en el dispositivo, que proporciona una API de TypeScript unificada para Browser, Node.js y React Native.
HelixDB es una base de datos OLTP graph-vector construida en Rust sobre almacenamiento de objetos, diseñada para grafos de conocimiento y memoria de IA.
Chroma es una infraestructura de datos de código abierto diseñada para IA que proporciona capacidades de búsqueda vectorial, híbrida y de texto completo.
LightRAG es un framework ligero de generación aumentada por recuperación basado en grafos, desarrollado por HKUDS. Ofrece recuperación dual, indexación de grafos de conocimiento, análisis multimodal, múltiples backends de almacenamiento y un servidor API con interfaz web.
KAG es un framework de código abierto de OpenSPG que combina grafos de conocimiento con LLM para razonamiento lógico y preguntas y respuestas factuales sobre bases de conocimiento de dominio profesional, usando recuperación híbrida guiada por formas lógicas y razonamiento.
Un framework de IA todo en uno para búsqueda semántica, orquestación de LLM y flujos de trabajo.
Vector Watcher es una GUI de escritorio multiplataforma para explorar y gestionar bases de datos vectoriales LanceDB, desarrollada con Tauri, React y TypeScript sobre un sidecar de Python/FastAPI.
Deep Lake es una base de datos multimodal serverless para IA que combina búsqueda vectorial con almacenamiento de embeddings, imágenes, video, audio y documentos. Transmite datos directamente desde almacenamiento en la nube a PyTorch/TensorFlow, soporta versionado y se integra con LangChain, LlamaIndex y Weights & Biases.
Qdrant es un motor de búsqueda de similitud vectorial y base de datos de alto rendimiento escrito en Rust, diseñado para aplicaciones de IA que requieren búsqueda semántica y gestión de vectores a gran escala.
Faiss es una biblioteca de C++ con envoltorios de Python para búsqueda de similitud y agrupamiento eficiente de vectores densos, que admite índices de CPU y GPU, cuantización y conjuntos de datos a escala de miles de millones.
OpenViking es una base de datos de contexto de código abierto para agentes de IA que unifica memoria, RAG de conocimiento y habilidades bajo un sistema de archivos virtual (viking://). Ofrece carga de contexto por capas, recuperación con alcance de directorio, extracción de sesión a memoria, SDKs, integraciones MCP y un servidor autoalojable.