Sobre o projeto

aiHelpDesk é uma camada de responsabilidade para equipes que usam agentes de IA em bancos de dados de produção. Ele diagnostica incidentes, propõe remediações e executa correções em VMs, hardware dedicado, contêineres Docker/Podman ou clusters Kubernetes. Cada ação crítica é aprovada, auditada e certificada como consistente. **Capacidades principais:** Teste de injeção de falhas — injeta 32 modos conhecidos de falha (apenas SQL, SSH, K8s) contra um banco de dados de staging para pontuar o diagnóstico do agente e verificar a recuperação da remediação. A ferramenta `faulttest` funciona sem acesso ao cluster. Operações em frota — coordena alterações em múltiplos bancos de dados com fases de canário, gates de aprovação, detecção de drift de schema e trilhas de auditoria completas. Um Planner em linguagem natural converte solicitações de texto livre em planos de frota. Playbooks — runbooks salvos combinando intenção com orientação especializada. Playbooks do sistema vêm com a ferramenta; playbooks personalizados podem ser autorados, importados ou gerados automaticamente a partir de traços de incidentes. Governança de IA — framework de oito módulos incluindo logs de auditoria à prova de manipulação, imposição de blast radius, proteções fora do horário comercial e avaliação de políticas em tempo real. Aprovação humana é exigida antes de qualquer ação destrutiva. Diagnósticos de incidentes — o agente de incidentes coleta dados das camadas de banco de dados, K8s, SO e armazenamento em um pacote de suporte com carimbo de tempo. Após a resolução, ele gera automaticamente um rascunho de playbook a partir da trilha de auditoria. **Memória institucional:** Todo incidente resolvido propõe um rascunho de playbook; cada `faulttest` bem-sucedido salva automaticamente um rascunho. Operadores humanos revisam e ativam. Consultas em texto livre são correspondidas a sintomas codificados e roteadas automaticamente. **Certificação de estabilidade:** Antes que um playbook entre em uso em produção, ele é certificado em três dimensões: resultado (foi bem-sucedido?), conclusão (o agente chegou ao mesmo diagnóstico em todas as execuções?) e avaliação (o avaliador concordou consigo mesmo?). Certificados como `STABLE(7) attr=oom-kill (7/7)` fornecem prova auditável de raciocínio consistente e correto. **Arquitetura:** Construído sobre Google ADK para Go. Agentes especialistas (Database, Kubernetes, Sysadmin, Incident, Orchestrator) são intercambiáveis ou extensíveis via protocolo A2A. O sistema é agnóstico a modelos e testado com modelos Anthropic e Gemini. **Opções de implantação:** Docker/Podman, instalação direta no host ou Kubernetes via Helm. Binários estão disponíveis para Linux x86-64, ARM (Graviton, Ampere) e macOS (Intel e Apple Silicon). **Agentes upstream:** Agentes aiHelpDesk podem ser invocados por humanos via Orchestrator ou por agentes upstream e programas via protocolo A2A e API REST Gateway. Bots companheiros incluem SREBot (monitor de observabilidade), SecBot (respondedor de segurança) e GovBot (relator de conformidade).