Sobre o projeto
aiHelpDesk é uma camada de responsabilidade para equipes que usam agentes de IA em bancos de dados de produção. Ele diagnostica incidentes, propõe remediações e executa correções em VMs, hardware dedicado, contêineres Docker/Podman ou clusters Kubernetes. Cada ação crítica é aprovada, auditada e certificada como consistente.
**Capacidades principais:**
Teste de injeção de falhas — injeta 32 modos conhecidos de falha (apenas SQL, SSH, K8s) contra um banco de dados de staging para pontuar o diagnóstico do agente e verificar a recuperação da remediação. A ferramenta `faulttest` funciona sem acesso ao cluster.
Operações em frota — coordena alterações em múltiplos bancos de dados com fases de canário, gates de aprovação, detecção de drift de schema e trilhas de auditoria completas. Um Planner em linguagem natural converte solicitações de texto livre em planos de frota.
Playbooks — runbooks salvos combinando intenção com orientação especializada. Playbooks do sistema vêm com a ferramenta; playbooks personalizados podem ser autorados, importados ou gerados automaticamente a partir de traços de incidentes.
Governança de IA — framework de oito módulos incluindo logs de auditoria à prova de manipulação, imposição de blast radius, proteções fora do horário comercial e avaliação de políticas em tempo real. Aprovação humana é exigida antes de qualquer ação destrutiva.
Diagnósticos de incidentes — o agente de incidentes coleta dados das camadas de banco de dados, K8s, SO e armazenamento em um pacote de suporte com carimbo de tempo. Após a resolução, ele gera automaticamente um rascunho de playbook a partir da trilha de auditoria.
**Memória institucional:** Todo incidente resolvido propõe um rascunho de playbook; cada `faulttest` bem-sucedido salva automaticamente um rascunho. Operadores humanos revisam e ativam. Consultas em texto livre são correspondidas a sintomas codificados e roteadas automaticamente.
**Certificação de estabilidade:** Antes que um playbook entre em uso em produção, ele é certificado em três dimensões: resultado (foi bem-sucedido?), conclusão (o agente chegou ao mesmo diagnóstico em todas as execuções?) e avaliação (o avaliador concordou consigo mesmo?). Certificados como `STABLE(7) attr=oom-kill (7/7)` fornecem prova auditável de raciocínio consistente e correto.
**Arquitetura:** Construído sobre Google ADK para Go. Agentes especialistas (Database, Kubernetes, Sysadmin, Incident, Orchestrator) são intercambiáveis ou extensíveis via protocolo A2A. O sistema é agnóstico a modelos e testado com modelos Anthropic e Gemini.
**Opções de implantação:** Docker/Podman, instalação direta no host ou Kubernetes via Helm. Binários estão disponíveis para Linux x86-64, ARM (Graviton, Ampere) e macOS (Intel e Apple Silicon).
**Agentes upstream:** Agentes aiHelpDesk podem ser invocados por humanos via Orchestrator ou por agentes upstream e programas via protocolo A2A e API REST Gateway. Bots companheiros incluem SREBot (monitor de observabilidade), SecBot (respondedor de segurança) e GovBot (relator de conformidade).
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.