Sobre o projeto

Agent Skills for Context Engineering é uma coleção aberta de habilidades focada em engenharia de contexto e engenharia de harness para construir sistemas de agente de IA de nível de produção. Ela aborda o desafio de gerenciar o orçamento limitado de atenção de um modelo de linguagem por meio da curadoria cuidadosa de prompts de sistema, definições de ferramentas, documentos recuperados, histórico de mensagens e saídas de ferramentas. O repositório organiza as habilidades em várias categorias. As habilidades fundamentais cobrem fundamentos de contexto, padrões de degradação como o efeito "lost-in-the-middle" e estratégias de compressão. As habilidades arquiteturais abordam padrões multiagente, prompts de longo horizonte, sistemas de memória, design de ferramentas, contexto baseado em sistema de arquivos e agentes hospedados. As habilidades operacionais incluem otimização de contexto, briefing latente, estruturas de avaliação, técnicas de LLM-como-Juiz, engenharia de harness e loops de autoaperfeiçoamento. Habilidades adicionais cobrem metodologia de desenvolvimento de projetos e estados mentais BDI para arquitetura cognitiva. As habilidades seguem um design de divulgação progressiva: os agentes carregam apenas nomes e descrições de habilidades na inicialização, com o conteúdo completo ativado sob demanda. Elas são independentes de plataforma e funcionam em Claude Code, Cursor, Codex e outros hosts que suportam a especificação Agent Skills. A instalação está disponível como um marketplace de plugins do Claude Code ou via Open Plugins para Cursor e Codex. Exemplos demonstram designs completos de sistema combinando múltiplas habilidades, incluindo um sistema operacional pessoal de cérebro digital, um sistema multiagente de X-para-livro, ferramentas de avaliação LLM-como-juiz, um pipeline de treinamento SFT de livros e um laboratório de prompts de longo horizonte. Um diretório de pesquisadores fornece um sistema operacional baseado em arquivos para transformar pesquisas externas em mudanças de habilidades, com resultados de benchmark para precisão de roteamento de habilidades em modelos de fronteira.