Sobre o projeto

O Agent Governance Toolkit (AGT) é um projeto open-source da Microsoft para governar agentes de IA autônomos em produção. Sua premissa é que instruções de segurança em nível de prompt não são uma superfície de controle confiável, portanto a governança é aplicada de forma determinística no código da aplicação antes que a intenção de um agente chegue a uma ferramenta, canal de mensagens ou outro agente. Capacidades principais - Aplicação de políticas: políticas YAML (com menção a OPA/Cedar) avaliadas em cada chamada de ferramenta; as decisões podem permitir, negar ou exigir aprovação humana. Um wrapper `govern()` de duas linhas verifica, registra e lança `GovernanceDenied` em ações bloqueadas. - Identidade e confiança: identidade zero-trust usando conceitos de SPIFFE/DID/mTLS, descoberta de agentes, roteamento e pontuação de confiança em uma malha, além de cadeias de delegação. - Sandboxing de execução: um Agent Runtime com quatro anéis de privilégio, orquestração saga, controle de terminação e aplicação de lista de comandos negados. - Engenharia de confiabilidade (Agent SRE): kill switch, monitoramento de SLO, orçamentos de erro, testes de caos e circuit breakers. - Auditoria e conformidade: trilhas de auditoria à prova de adulteração (Merkle), registros de decisão, verificação OWASP, linting de políticas e verificações de integridade via uma CLI `agt`. - Gateway de segurança MCP: detecção de envenenamento de ferramentas, monitoramento de drift, typosquatting e varredura de instruções ocultas. - Ferramentas adicionais: descoberta de shadow AI, um dashboard de governança em Streamlit, um avaliador de injeção de prompt com 12 vetores e uma GitHub Action de reputação de contribuidores. Pacotes e linguagens Python é a stack completa, distribuída como pacotes consolidados (core, runtime, sre, cli e um meta-pacote `[full]`). Também existem SDKs para TypeScript, .NET (incluindo uma extensão MCP), Rust e Go, cobrindo políticas centrais, identidade, confiança e auditoria. As superfícies de desenvolvedor first-party incluem plugins/instaladores para Claude Code, GitHub Copilot CLI, Codex CLI e OpenCode. Integrações com frameworks Middleware nativo para Microsoft Agent Framework e Semantic Kernel; adaptadores ou middleware para AutoGen, LangGraph/LangChain, CrewAI, OpenAI Agents SDK, Google ADK, LlamaIndex, Haystack, Mastra e Dify; orientação de implantação para Azure AI Foundry. Especificações e padrões Dez especificações formais RFC 2119 com 992 testes de conformidade declarados e 29 registros de decisão de arquitetura. Mapeamentos de conformidade são fornecidos para OWASP Agentic AI Top 10, NIST AI RMF 1.0, EU AI Act, SOC 2, AARM Extended e ATF. Postura de segurança e limitações O README afirma que a governança é executada na camada de middleware da aplicação, não no kernel do sistema operacional, portanto o motor de políticas e os agentes compartilham um limite de processo; recomenda executar cada agente em um contêiner separado para isolamento em nível de SO. Também vincula um documento de Limitações Conhecidas. O projeto está rotulado como prévia pública e pode introduzir mudanças disruptivas antes da disponibilidade geral. O ferramental inclui CodeQL, Gitleaks, alvos de fuzzing ClusterFuzzLite, Dependabot e OpenSSF Scorecard.