Sobre el proyecto

Vole es un monitor local-first de uso, coste y anomalías para agentes de codificación de IA. Está diseñado para desarrolladores que ejecutan varios agentes en paralelo y quieren saber si un agente se está comportando incorrectamente, no solo cuánto ha gastado. La aplicación se ejecuta en macOS 26 o superior para Apple silicon y reside en la barra de menús. Lee los registros que las herramientas de codificación ya escriben en el disco, los normaliza en un esquema común y mantiene todo local: sin APIs en la nube, sin cuenta y sin almacenar contenido de prompts ni de herramientas. Solo requiere permiso opcional para notificaciones y no solicita acceso completo al disco porque las fuentes son dotfiles locales y archivos de soporte de aplicaciones. Vole admite varias herramientas, incluidas Claude Code, OpenCode, Codex CLI, Grok CLI, Cursor, Devin y Antigravity. Distingue niveles de confianza de datos: valores exactos leídos directamente de los registros de la herramienta, estimaciones deterministas con un método registrado y filas de solo actividad cuando una herramienta registra que se realizó una llamada, pero no hay detalles suficientes para medir tokens. Los totales indican qué niveles incluyen, y los modelos desconocidos devuelven NULL en lugar de ser adivinados. El panel proporciona cifras principales de tokens y coste, un minigráfico, barras por herramienta y una línea de tiempo anotada con incidentes. La línea de tiempo apila tokens por herramienta y marca incidentes, lo que facilita inspeccionar los picos y sus causas. El elemento de la barra de menús puede mostrar tokens en vivo, coste o simplemente una marca de estado, y se tiñe mientras hay un incidente abierto. La detección de anomalías incluye reglas para picos de consumo facturable, bucles de llamadas repetidas, tormentas de errores, presión por límites de tasa y presión de contexto. Las líneas base utilizan comparación leave-one-out para que un único pico no se oculte dentro de su propia línea base. La detección de bucles combina el volumen de llamadas con salida plana y lecturas de caché en aumento para reducir los falsos positivos. El coste se calcula como valor equivalente de API a precio de lista, no como facturación de suscripción. Las tarifas de precios se almacenan como datos versionados, pueden sobrescribirse en cada instalación y los modelos desconocidos se dejan como null. Un comando de verificación vuelve a derivar de forma independiente las filas almacenadas a partir de sus registros fuente para detectar errores de precios o de análisis. El proyecto también incluye comandos CLI para sesiones en vivo, resúmenes, tablas de uso de PR, líneas de estado, hallazgos de optimización, límites de presupuesto, eficiencia de modelos y comprobaciones de salud. Un servidor MCP expone los mismos datos locales a los agentes, permitiendo que un agente consulte el coste de su propia sesión, el uso de contexto y el estado de incidentes. Los límites de presupuesto pueden aplicarse mediante hooks compatidores donde estén disponibles, mientras que siguen siendo advisory para herramientas sin soporte de hooks. Las limitaciones conocidas incluyen datos locales de tokens limitados para Devin y Antigravity, tiempos de mensajes de Cursor parcialmente derivados, la reciente falta de recuentos locales de tokens en Cursor, cobertura de errores solo mediante API, velocidades de generación de límite inferior para algunas herramientas y resolución de ventana de contexto solo para IDs de modelos propios.