Sobre el proyecto
Manticore Search es una base de datos de código abierto creada específicamente para cargas de trabajo de búsqueda, posicionada como una alternativa a Elasticsearch. Combina búsqueda de texto completo, búsqueda vectorial y recuperación híbrida en un solo motor, con indexación en tiempo real para que los documentos recién insertados o actualizados sean buscables de inmediato.
Capacidades clave descritas en el README:
- Búsqueda de texto completo con más de 20 operadores y factores de ranking, ranking personalizado, búsqueda difusa, búsqueda facetada, búsqueda geoespacial, autocompletado, corrección ortográfica y uniones de tablas.
- Búsqueda vectorial e híbrida, incluida la recuperación KNN, auto-embeddings con chunking automático (de tamaño fijo, recursivo o basado en oraciones) almacenados en un float_vector_array, y búsqueda conversacional mediante SQL CALL CHAT o el endpoint HTTP JSON /search.
- Interfaz SQL-first compatible con MySQL, para que los usuarios puedan conectarse con clientes MySQL familiares. También se proporcionan una API HTTP JSON y escrituras compatibles con Elasticsearch.
- Opciones de almacenamiento: almacenamiento por filas para velocidad, almacenamiento columnar (mediante la Manticore Columnar Library) para conjuntos de datos mayores que la RAM, y un modo docstore que evita el uso de RAM para recuperar valores originales.
- Índices secundarios automáticos mediante el PGM-index, y un optimizador de consultas basado en costos que utiliza estadísticas indexadas para elegir planes de ejecución.
- Ejecución de consultas multihilo y paralelización de consultas entre núcleos de CPU.
- Tablas fragmentadas que distribuyen lecturas y escrituras entre fragmentos en un nodo o en un clúster de replicación, con replicación multi-master prácticamente síncrona basada en Galera y balanceo de carga integrado.
- Autenticación y autorización integradas para MySQL, HTTP/HTTPS, agentes distribuidos y replicación, usando usuarios, bearer tokens y permisos detallados, además de soporte HTTPS y un modo de solo lectura.
- Sincronización de datos desde MySQL, PostgreSQL, ODBC, MS SQL, XML, CSV y Kafka, e integraciones con ProxySQL, Apache Superset, Grafana, Fluentbit, Kibana, Logstash/Filebeat, Vector.dev y mysqldump.
- Copia de seguridad y recuperación mediante la herramienta manticore-backup, el comando SQL BACKUP y copia de seguridad/restauración compatible con S3.
- Funciones de NLP que incluyen stemming, lematización, stopwords, sinónimos, wordforms, tokenización de bajo nivel, segmentación de chino y resaltado de texto.
- Filtrado de flujos mediante una tabla percolate o integración con Kafka.
- Clientes oficiales para PHP, Python, Python asyncio, JavaScript, TypeScript, Java, Elixir, Go y Rust.
Las opciones de instalación incluyen un instalador de shell de una línea para Linux y macOS (Homebrew), imágenes Docker, repositorios RPM y APT, Homebrew en macOS, e instrucciones para WSL o Windows nativo. El README señala que el proyecto se distribuye bajo GPLv3 o posterior y que redistribuye otros componentes de código abierto. También indica que Manticore es utilizado por organizaciones como Craigslist, Socialgist, PubChem y Rozetka, y enlaza a documentación, cursos interactivos, un foro, y canales de Slack y Telegram.
Comments
0 people shared their preference · Deer Point appears after 10 participants
Sign in to join the discussion.