À propos du projet

ai-jury est un outil en ligne de commande qui orchestre plusieurs agents IA au sein d'un panel de revue pour les modifications de code. Plutôt que d'appeler les modèles uniquement au niveau de l'API, il pilote les CLI natifs d'agents de codage (Claude Code, Codex, Antigravity), les fournisseurs d'API hébergées (Anthropic, OpenAI, Gemini, xAI Grok, OpenRouter, DeepSeek, Groq et d'autres points de terminaison compatibles OpenAI), des modèles locaux à poids ouverts gratuits via Ollama, llama.cpp, vLLM ou LM Studio, ainsi que des agents CLI arbitraires comme Aider. Chaque relecteur s'exécute en mode sans interface dans son propre environnement ; l'orchestrateur contrôle la structure des tours. Le flux de travail est une délibération en deux tours : les relecteurs examinent indépendamment le même diff, PR ou ticket en parallèle, puis réfutent les conclusions des autres, après quoi un agent président vérifie et synthétise un verdict unique (APPROVE / COMMENT / REQUEST CHANGES) ou le panel décide par vote. Il prend en charge la revue des pull requests GitHub, des diffs locaux et des tickets (avec les résultats READY / NEEDS-INFO / UNCLEAR). Parmi les capacités notables figurent une configuration `jury init` qui détecte les agents installés et les modèles locaux, des préréglages (offline, fast, balanced, thorough), une sortie en direct et en transcription complète, une vue de délibération « théâtre » animée en styles flat ou pixel-art, la relecture d'exécutions enregistrées sans redépenser de tokens, la revue incrémentale, des correctifs suggérés, le découpage des gros diffs et le contrôle en CI. Les formats de sortie incluent markdown, JSON, SARIF et un tableau keel-reviews par relecteur. Un hook pre-commit et une GitHub Action sont fournis. Le projet met l'accent sur la sécurité par défaut : les relecteurs s'exécutent en bac à sable ou en lecture seule, et le runtime ne dépend que de la bibliothèque standard (Python 3.11+). Il fournit un mode simulé pour les démos hors ligne, une suite de tests de fumée en direct optionnelle et un petit benchmark directionnel comparant les modèles seuls à un panel. L'installation est possible via Homebrew, un installateur curl ou pipx, et l'outil peut aussi être installé comme plugin dans Claude Code, Codex, Antigravity ou Cursor.