Sobre el proyecto

aiHelpDesk es una capa de responsabilidad para equipos que usan agentes de IA en bases de datos de producción. Diagnostica incidentes, propone remediación y ejecuta correcciones en VM, bare metal, contenedores Docker/Podman o clústeres Kubernetes. Toda acción con consecuencias se aprueba, audita y certifica como consistente. Capacidades principales: Pruebas de inyección de fallos — inyecta 32 modos de fallo conocidos (solo SQL, SSH, K8s) contra una base de datos de staging para puntuar el diagnóstico del agente y verificar la recuperación de la remediación. La herramienta faulttest funciona sin acceso al clúster. Operaciones de flota — coordina cambios en varias bases de datos con fases canario, puertas de aprobación, detección de deriva de esquema y rastros de auditoría completos. Un Planner en lenguaje natural convierte solicitudes de texto libre en planes de flota. Playbooks — runbooks guardados que combinan intención con orientación experta. Los playbooks del sistema se incluyen con la herramienta; los playbooks personalizados se crean, importan o autogeneran a partir de trazas de incidentes. Gobernanza de IA — marco de ocho módulos que incluye registros de auditoría a prueba de manipulaciones, aplicación del radio de impacto, protecciones fuera de horario y evaluación de políticas en tiempo real. Se requiere aprobación humana antes de cualquier acción destructiva. Diagnóstico de incidentes — el agente de incidentes recopila datos de base de datos, K8s, SO y capa de almacenamiento en un paquete de soporte con marca de tiempo. Al resolverse, sintetiza automáticamente un borrador de playbook a partir de la traza de auditoría. Memoria institucional: Cada incidente resuelto propone un borrador de playbook; cada faulttest exitoso guarda automáticamente un borrador. Los operadores humanos los revisan y activan. Las consultas de texto libre se comparan con síntomas codificados y se enrutan automáticamente. Certificación de estabilidad: Antes de que un playbook entre en rotación activa, se certifica en tres dimensiones: resultado (¿pasó?), conclusión (¿el agente llegó al mismo diagnóstico en cada ejecución?) y evaluación (¿el juez coincidió consigo mismo?). Certificados como STABLE(7) attr=oom-kill (7/7) proporcionan prueba auditable de razonamiento consistente y correcto. Arquitectura: Construido sobre Google ADK para Go. Los agentes expertos (Database, Kubernetes, Sysadmin, Incident, Orchestrator) son intercambiables o extensibles mediante el protocolo A2A. El sistema es agnóstico al modelo y se prueba con modelos Anthropic y Gemini. Opciones de despliegue: Docker/Podman, instalación directa en el host o Kubernetes mediante Helm. Hay binarios disponibles para Linux x86-64, ARM (Graviton, Ampere) y macOS (Intel y Apple Silicon). Agentes upstream: Los agentes de aiHelpDesk pueden ser llamados por humanos mediante el Orchestrator o por agentes y programas upstream mediante el protocolo A2A y la Gateway REST API. Los bots complementarios incluyen SREBot (vigilante de observabilidad), SecBot (respondedor de seguridad) y GovBot (reportero de cumplimiento).