프로젝트 소개

ai-jury는 여러 AI 에이전트를 코드 변경 검토 패널로 구성하는 명령줄 도구다. API 수준에서만 모델을 호출하는 대신 네이티브 코딩 에이전트 CLI(Claude Code, Codex, Antigravity), 호스팅 API 제공자(Anthropic, OpenAI, Gemini, xAI Grok, OpenRouter, DeepSeek, Groq 및 기타 OpenAI 호환 엔드포인트), Ollama, llama.cpp, vLLM 또는 LM Studio를 통한 무료 로컬 오픈 웨이트 모델, 그리고 Aider 같은 임의의 CLI 에이전트를 구동한다. 각 검토자는 자체 환경에서 헤드리스로 실행되며, 오케스트레이터가 라운드 구조를 제어한다. 워크플로는 2라운드 심의다. 검토자들이 동일한 diff, PR 또는 이슈를 병렬로 독립 검토한 뒤 서로의 발견에 반박하고, 이후 의장 에이전트가 검증해 단일 판정(APPROVE / COMMENT / REQUEST CHANGES)으로 종합하거나 패널이 투표로 결정한다. GitHub 풀 리퀘스트, 로컬 diff, 이슈(READY / NEEDS-INFO / UNCLEAR 결과) 검토를 지원한다. 주요 기능으로는 설치된 에이전트와 로컬 모델을 감지하는 `jury init` 설정, 프리셋(offline, fast, balanced, thorough), 실시간 및 전체 기록 출력, 플랫 또는 픽셀 아트 스타일의 애니메이션 "theater" 심의 뷰, 토큰을 다시 쓰지 않고 저장된 실행을 재생하는 기능, 증분 검토, 제안 패치, 대규모 diff 청킹, CI 게이팅이 있다. 출력 형식은 markdown, JSON, SARIF, 검토자별 keel-reviews 배열을 포함한다. pre-commit 훅과 GitHub Action이 제공된다. 이 프로젝트는 기본적으로 보안을 강조한다. 검토자는 샌드박스 또는 읽기 전용으로 실행되며, 런타임은 표준 라이브러리만 사용한다(Python 3.11+). 오프라인 데모용 mock 모드, 선택적 라이브 스모크 테스트 스위트, 단독 모델과 패널을 비교하는 소규모 방향성 벤치마크를 제공한다. Homebrew, curl 설치 프로그램 또는 pipx로 설치할 수 있으며, Claude Code, Codex, Antigravity 또는 Cursor에 플러그인으로도 설치할 수 있다.