À propos du projet
wigolo est un outil d'intelligence web local-first qui offre aux agents IA une surface unifiée pour les tâches liées au web : recherche, récupération, exploration, extraction, cache, similarité, recherche approfondie et boucles autonomes de collecte. Il fonctionne comme serveur MCP aux côtés des agents de codage, comme point de terminaison REST pour agents auto-hébergés, ou intégré via SDK. Les outils de base ne nécessitent pas de clés API, toutes les données restent sous ~/.wigolo/, et il n'y a aucun coût par requête.
Les agents pris en charge incluent Claude Code, Cursor, Codex, Gemini CLI, OpenCode, VS Code, Windsurf, Zed et Antigravity. Tout client MCP peut l'enregistrer via npx. Des intégrations de frameworks existent pour LangChain, CrewAI, LlamaIndex et Vercel AI SDK.
Outils clés :
- search : Recherche web multi-moteurs (18 adaptateurs directs) avec fusion de classements, reclassement ML et notation explicable par résultat. Prend en charge les tableaux de requêtes pour une largeur parallèle, le cadrage domaine/temporel et les résultats d'images.
- fetch : Routeur hiérarchisé passant de HTTP simple à navigateur sans tête lors de défis anti-bot ou de coquilles SPA. Renvoie du markdown propre, métadonnées, liens. Gère les PDF, sessions authentifiées et actions de page (clic/saisie/défilement/capture d'écran).
- crawl : Exploration multi-pages (BFS, DFS, sitemap ou carte seule) avec limites de débit par domaine, respect de robots.txt et déduplication de contenu générique.
- extract : Extraction de données structurées — tableaux, métadonnées, JSON-LD, schémas nommés (Article/Recette/Produit) ou schéma JSON personnalisé.
- cache : Interroge les résultats précédemment vus via recherche par mots-clés ou sémantique hybride, avec statistiques, effacement et détection de changements.
- find_similar : Pages similaires à une URL ou un concept via fusion à 3 voies de signaux de mots-clés, sémantiques et web en direct.
- research : Décompose une question en sous-requêtes, récupère des sources et synthétise un rapport cité.
- agent : Boucle autonome de collecte avec plan/recherche/récupération/extraction/synthèse, journal d'étapes, budget de temps et schéma de sortie optionnel.
- diff + watch : Suit les changements de page depuis la dernière visite, revérifie à la demande, livre au webhook.
Chaque résultat porte un extrait textuel épinglé à des plages de source à décalage d'octets, un ID de citation et un score de preuve. Les résultats faibles sont marqués comme indésirables ; les moteurs en échec et le cache obsolète sont étiquetés. Le routeur fetch apprend par domaine quand escalader vers un navigateur réel et désapprend quand un site n'en a plus besoin.
Installation via npx wigolo init (avec option --agents pour connecter des agents spécifiques). Nécessite Node >= 20 et ~1,5 Go d'espace disque sur macOS, Linux ou Windows. Images Docker disponibles (slim et :full avec moteur de navigateur préinstallé). SDK TypeScript et Python fournis. Un catalogue de compétences en 11 packs enseigne aux agents de codage à utiliser chaque outil.
Fournisseur LLM optionnel (Gemini, Anthropic, OpenAI, Groq ou Ollama local) permet des réponses synthétisées citées pour les outils de recherche/agent ; sans lui, des briefs bruts et preuves sont renvoyés pour que le LLM hôte les assemble. Sous licence AGPL-3.0, actuellement en bêta publique.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.