Sobre el proyecto
aiHelpDesk es una capa de responsabilidad para equipos que usan agentes de IA en bases de datos de producción. Diagnostica incidentes, propone remediación y ejecuta correcciones en VM, bare metal, contenedores Docker/Podman o clústeres Kubernetes. Toda acción con consecuencias se aprueba, audita y certifica como consistente.
Capacidades principales:
Pruebas de inyección de fallos — inyecta 32 modos de fallo conocidos (solo SQL, SSH, K8s) contra una base de datos de staging para puntuar el diagnóstico del agente y verificar la recuperación de la remediación. La herramienta faulttest funciona sin acceso al clúster.
Operaciones de flota — coordina cambios en varias bases de datos con fases canario, puertas de aprobación, detección de deriva de esquema y rastros de auditoría completos. Un Planner en lenguaje natural convierte solicitudes de texto libre en planes de flota.
Playbooks — runbooks guardados que combinan intención con orientación experta. Los playbooks del sistema se incluyen con la herramienta; los playbooks personalizados se crean, importan o autogeneran a partir de trazas de incidentes.
Gobernanza de IA — marco de ocho módulos que incluye registros de auditoría a prueba de manipulaciones, aplicación del radio de impacto, protecciones fuera de horario y evaluación de políticas en tiempo real. Se requiere aprobación humana antes de cualquier acción destructiva.
Diagnóstico de incidentes — el agente de incidentes recopila datos de base de datos, K8s, SO y capa de almacenamiento en un paquete de soporte con marca de tiempo. Al resolverse, sintetiza automáticamente un borrador de playbook a partir de la traza de auditoría.
Memoria institucional: Cada incidente resuelto propone un borrador de playbook; cada faulttest exitoso guarda automáticamente un borrador. Los operadores humanos los revisan y activan. Las consultas de texto libre se comparan con síntomas codificados y se enrutan automáticamente.
Certificación de estabilidad: Antes de que un playbook entre en rotación activa, se certifica en tres dimensiones: resultado (¿pasó?), conclusión (¿el agente llegó al mismo diagnóstico en cada ejecución?) y evaluación (¿el juez coincidió consigo mismo?). Certificados como STABLE(7) attr=oom-kill (7/7) proporcionan prueba auditable de razonamiento consistente y correcto.
Arquitectura: Construido sobre Google ADK para Go. Los agentes expertos (Database, Kubernetes, Sysadmin, Incident, Orchestrator) son intercambiables o extensibles mediante el protocolo A2A. El sistema es agnóstico al modelo y se prueba con modelos Anthropic y Gemini.
Opciones de despliegue: Docker/Podman, instalación directa en el host o Kubernetes mediante Helm. Hay binarios disponibles para Linux x86-64, ARM (Graviton, Ampere) y macOS (Intel y Apple Silicon).
Agentes upstream: Los agentes de aiHelpDesk pueden ser llamados por humanos mediante el Orchestrator o por agentes y programas upstream mediante el protocolo A2A y la Gateway REST API. Los bots complementarios incluyen SREBot (vigilante de observabilidad), SecBot (respondedor de seguridad) y GovBot (reportero de cumplimiento).
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.