À propos du projet
GrooveSeek est un serveur MCP pour la recherche hybride — sémantique plus plein texte — sur une base de connaissances de fichiers Markdown, avec texte brut, PDF, documents Office et code source disponibles en option. La commande est `groove`.
Prêt à l'emploi, sans fichier de configuration et avec le modèle par défaut, il indexe le Markdown anglais avec frontmatter YAML. Le contenu multilingue ou japonais nécessite `--model bge-m3` ; tous les autres formats de fichiers sont activés dans `groove.toml`.
Comment cela fonctionne : le Markdown (et optionnellement .txt, .pdf, .docx, .xlsx, .pptx, plus le code source Rust depuis v1.2.0, Python depuis v1.3.0 et PHP depuis v1.5.0, dont les grammaires sont téléchargées et placées manuellement) est analysé avec frontmatter YAML et divisé en segments basés sur les titres — ou, pour le code source, un segment par définition. Les intégrations sont générées avec FastEmbed par défaut (BGE-small-en-v1.5, ou BGE-M3 pour les bases de connaissances multilingues) et stockées dans SQLite avec sqlite-vec pour la recherche de similarité vectorielle. Une configuration de confiance peut plutôt opter pour un point de terminaison d'intégration compatible OpenAI.
Les clients se connectent via stdio (par défaut, un client) ou Streamable HTTP (plusieurs clients), donc cela fonctionne avec Claude Code, Cursor ou tout client compatible MCP. Un observateur de fichiers en synchronisation en direct maintient l'index à jour lors de modifications manuelles, `git pull` et scripts externes. Un schéma TOML optionnel peut valider les conventions de frontmatter via `groove validate`, et depuis v1.9.0, les clés supplémentaires qu'il déclare sont stockées par `groove index` afin que `groove search --field` puisse filtrer dessus.
La surface MCP expose six outils — `search`, `get_document`, `list_topics`, `get_connection_graph`, `get_best_practice`, `rebuild_index` — quatre invites, et la base de connaissances comme ressources `kb://`. Avec `--transport http`, le serveur répond également sur `/ui`, une vue opérateur montrant la version, les nombres de documents et de segments, le modèle d'intégration, l'état de l'observateur, la durée de fonctionnement et le pid, avec recherche via le même point de terminaison `/mcp` utilisé par les clients.
L'installation se fait via des binaires précompilés pour Linux x86_64 et aarch64, macOS Apple Silicon et Windows x86_64, avec sommes de contrôle SHA-256 et attestations d'artefacts GitHub ; les builds Intel Mac doivent provenir de la source. Le runtime ONNX et SQLite sont liés statiquement, et les modèles d'intégration sont téléchargés depuis HuggingFace au premier lancement. La compilation depuis la source est `cargo build --release`.
Le démarrage rapide est `groove index --kb-path /chemin/vers/base-de-connaissances`, puis une entrée `.mcp.json` pointant vers `groove serve --kb-path ...`, ou des requêtes directes avec `groove search "..." --limit 3`. La documentation couvre les commandes, les clés de configuration, les recettes client, le pipeline de récupération (RRF, reclassement, MMR, récupérateur parent), les filtres, les citations avec décalages d'octets, l'évaluation contre un ensemble de requêtes dorées, l'architecture et les garanties de stabilité ; une version japonaise de chaque page est fournie, et les pages sont publiées comme un site. Des recettes de déploiement pour stdio personnel, NAS partagé et configurations HTTP intranet sont incluses. Les versions avant 1.0.0 sont bêta sans garantie de compatibilité ; à partir de 1.0.0, le document de stabilité indique ce qui est figé et ce qui ne l'est pas délibérément, y compris l'interface web et l'API Rust. Sous double licence MIT ou Apache-2.0.
Comments
0 people shared their preference · Deer Point appears after 10 participants
Sign in to join the discussion.