Sobre el proyecto
wigolo es una herramienta de inteligencia web local-first que brinda a los agentes de IA una superficie unificada para tareas relacionadas con la web: búsqueda, fetch, rastreo, extracción, caché, búsqueda de similares, investigación y bucles de recopilación autónomos. Se ejecuta como servidor MCP junto a agentes de codificación, como endpoint REST para agentes autoalojados, o integrado mediante SDKs. Las herramientas principales no requieren claves API, todos los datos permanecen en ~/.wigolo/, y no hay costo por consulta.
Los agentes compatibles incluyen Claude Code, Cursor, Codex, Gemini CLI, OpenCode, VS Code, Windsurf, Zed y Antigravity. Cualquier cliente MCP puede registrarlo vía npx. Existen integraciones con frameworks como LangChain, CrewAI, LlamaIndex y Vercel AI SDK.
Herramientas clave:
- search: Búsqueda web multi-motor (18 adaptadores directos) con fusión de rankings, reordenamiento por ML y puntuación explicable por resultado. Admite arreglos de consultas para amplitud paralela, alcance por dominio/tiempo y resultados de imágenes.
- fetch: Enrutador por niveles que escala desde HTTP simple hasta navegador sin cabeza ante desafíos anti-bot o shells SPA. Devuelve markdown limpio, metadatos y enlaces. Maneja PDFs, sesiones autenticadas y acciones de página (clic/escribir/desplazar/captura).
- crawl: Rastreo multipágina (BFS, DFS, sitemap o solo mapa) con límites de tasa por dominio, respeto a robots.txt y deduplicación de contenido repetido.
- extract: Extracción de datos estructurados: tablas, metadatos, JSON-LD, esquemas nombrados (Artículo/Receta/Producto) o JSON Schema personalizado.
- cache: Consulta resultados vistos previamente mediante búsqueda por palabra clave o semántica híbrida, con estadísticas, limpieza y detección de cambios.
- find_similar: Páginas similares a una URL o concepto mediante fusión triple de señales de palabras clave, semánticas y web en vivo.
- research: Descompone una pregunta en subconsultas, obtiene fuentes y sintetiza un informe citado.
- agent: Bucle de recopilación autónomo con plan/búsqueda/fetch/extracción/síntesis, registro de pasos, presupuesto de tiempo y esquema de salida opcional.
- diff + watch: Rastrea cambios de página desde la última visita, re-verifica a demanda y entrega a webhook.
Cada resultado lleva un extracto textual anclado a rangos de bytes de origen, un ID de cita y una puntuación de evidencia. Los resultados débiles se marcan como basura; los motores fallidos y la caché obsoleta se etiquetan. El enrutador de fetch aprende por dominio cuándo escalar a un navegador real y desaprende cuando un sitio deja de necesitarlo.
Configuración mediante npx wigolo init (con bandera opcional --agents para conectar agentes específicos). Requiere Node >= 20 y ~1.5 GB de disco en macOS, Linux o Windows. Hay imágenes Docker disponibles (slim y :full con motor de navegador preinstalado). Se proporcionan SDKs en TypeScript y Python. Un catálogo de habilidades de 11 paquetes enseña a los agentes de codificación a usar cada herramienta.
Un proveedor LLM opcional (Gemini, Anthropic, OpenAI, Groq u Ollama local) habilita respuestas citadas sintetizadas para las herramientas de investigación/agente; sin uno, se devuelven informes crudos y evidencia para que el LLM anfitrión los ensamble. Licenciado bajo AGPL-3.0, actualmente en beta pública.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.