Sobre o projeto
oh-my-agent é um harness multiagente para agentes de codificação de IA cuja premissa central é que os agentes narram o sucesso enquanto o harness verifica os artefatos. É distribuído como um pacote npm e pode ser instalado como um pacote de habilidades (via npx skills add ou o Gerenciador de Pacotes de Agentes da Microsoft) ou como um harness completo com fluxos de trabalho, regras, configuração, ganchos de detecção de palavras-chave e uma CLI.
Os mecanismos centrais de verificação são descritos como mecânicos, não julgados por LLM. Um gancho de parada bloqueia o encerramento da sessão enquanto um fluxo de trabalho persistente está ativo e executa um script de portão configurado antes de permitir a parada; apenas typecheck, teste e lint são executáveis, e o portão é limitado a cinco reforços. Um portão anticircunvenção verifica artefatos que um atalho não pode falsificar, incluindo registros de fase, JSON de plano e arquivos de resultado de agentes distintos de QA e refatoração. Um juiz independente é gerado com contexto novo, instruído apenas sobre critérios, e reverifica cada critério a cada rodada, incluindo aprovações anteriores. Cada aprovação, falha e decisão do portão é anexada como linhas JSON a um log de eventos de sessão que é somente anexação e entre fornecedores.
Ferramentas adicionais incluem baterias de verificação por agente que cobrem violações de escopo, alinhamento com a carta, segredos codificados, varreduras de TODO e saídas declaradas, além de verificações específicas por tipo. Um harness de avaliação de habilidades mede o ganho de utilidade em tarefas retidas e mantém apenas edições que melhoram o ganho medido. Orçamentos limitam tokens, contagens de spawn e gastos por fornecedor, com o orquestrador recusando novos spawns quando os limites são excedidos.
O projeto inclui agentes baseados em papéis modelados como uma equipe de engenharia, incluindo agentes de arquitetura, backend, brainstorming, banco de dados, depuração, segurança profunda, design, fluxo de trabalho de desenvolvimento, documentação, explicação, frontend, mobile, observabilidade, orquestração, gerenciamento de projetos, QA, refatoração, controle de origem, busca e infraestrutura Terraform. Pipelines separados de conteúdo e pesquisa cobrem escrita acadêmica, conversão de HWP e PDF, geração de imagens, pesquisa de mercado, resumos de conversas, busca acadêmica, geração de slides, tradução, geração de vídeo e geração de voz.
O trabalho é conduzido por chat ou comandos de barra, como /brainstorm, /architecture, /plan, /work, /orchestrate, /ultrawork, /ralph, /review, /deepsec, /debug, /docs e /scm. A autodetecção de palavras-chave ativa fluxos de trabalho em vários idiomas, e a precisão da detecção é medida contra um corpus de prompts rotulados com portão de CI. O harness suporta muitos runtimes de agentes a partir de um único diretório .agents/, incluindo Claude Code, Codex CLI, Antigravity, Cursor, Qwen Code, OpenCode, GitHub Copilot e outros, com seleção de modelo por agente via configuração. É licenciado sob MIT.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.