Sobre el proyecto

Manticore Search es una base de datos de código abierto creada específicamente para cargas de trabajo de búsqueda, posicionada como una alternativa a Elasticsearch. Combina búsqueda de texto completo, búsqueda vectorial y recuperación híbrida en un solo motor, con indexación en tiempo real para que los documentos recién insertados o actualizados sean buscables de inmediato. Capacidades clave descritas en el README: - Búsqueda de texto completo con más de 20 operadores y factores de ranking, ranking personalizado, búsqueda difusa, búsqueda facetada, búsqueda geoespacial, autocompletado, corrección ortográfica y uniones de tablas. - Búsqueda vectorial e híbrida, incluida la recuperación KNN, auto-embeddings con chunking automático (de tamaño fijo, recursivo o basado en oraciones) almacenados en un float_vector_array, y búsqueda conversacional mediante SQL CALL CHAT o el endpoint HTTP JSON /search. - Interfaz SQL-first compatible con MySQL, para que los usuarios puedan conectarse con clientes MySQL familiares. También se proporcionan una API HTTP JSON y escrituras compatibles con Elasticsearch. - Opciones de almacenamiento: almacenamiento por filas para velocidad, almacenamiento columnar (mediante la Manticore Columnar Library) para conjuntos de datos mayores que la RAM, y un modo docstore que evita el uso de RAM para recuperar valores originales. - Índices secundarios automáticos mediante el PGM-index, y un optimizador de consultas basado en costos que utiliza estadísticas indexadas para elegir planes de ejecución. - Ejecución de consultas multihilo y paralelización de consultas entre núcleos de CPU. - Tablas fragmentadas que distribuyen lecturas y escrituras entre fragmentos en un nodo o en un clúster de replicación, con replicación multi-master prácticamente síncrona basada en Galera y balanceo de carga integrado. - Autenticación y autorización integradas para MySQL, HTTP/HTTPS, agentes distribuidos y replicación, usando usuarios, bearer tokens y permisos detallados, además de soporte HTTPS y un modo de solo lectura. - Sincronización de datos desde MySQL, PostgreSQL, ODBC, MS SQL, XML, CSV y Kafka, e integraciones con ProxySQL, Apache Superset, Grafana, Fluentbit, Kibana, Logstash/Filebeat, Vector.dev y mysqldump. - Copia de seguridad y recuperación mediante la herramienta manticore-backup, el comando SQL BACKUP y copia de seguridad/restauración compatible con S3. - Funciones de NLP que incluyen stemming, lematización, stopwords, sinónimos, wordforms, tokenización de bajo nivel, segmentación de chino y resaltado de texto. - Filtrado de flujos mediante una tabla percolate o integración con Kafka. - Clientes oficiales para PHP, Python, Python asyncio, JavaScript, TypeScript, Java, Elixir, Go y Rust. Las opciones de instalación incluyen un instalador de shell de una línea para Linux y macOS (Homebrew), imágenes Docker, repositorios RPM y APT, Homebrew en macOS, e instrucciones para WSL o Windows nativo. El README señala que el proyecto se distribuye bajo GPLv3 o posterior y que redistribuye otros componentes de código abierto. También indica que Manticore es utilizado por organizaciones como Craigslist, Socialgist, PubChem y Rozetka, y enlaza a documentación, cursos interactivos, un foro, y canales de Slack y Telegram.