프로젝트 소개

OpenAPPA는 AI 에이전트와 그 도구 사이에 위치하는 정책 시행 계층입니다. 각 행동 전에 관련 데이터가 요청된 목적지로 가도 되는지를 답합니다. 런타임은 에이전트가 읽는 정보의 민감도와 신뢰도를 추적하고 그 이력을 후속 도구 호출에 적용하며, 목표는 민감한 데이터가 권한 없는 도구에 도달하는 것을 막는 것입니다. 이 시스템은 APPA, Agentic Permissions Policy Algebra를 사용하며 정책은 선언적 TOML로 작성됩니다. README에 따르면 결정은 이벤트 로그만으로 산출되고 엔진은 평가 중 네트워크나 파일 호출을 하지 않으므로, 같은 로그는 반복해서 같은 결정을 내야 합니다. 인프로세스에 내장하거나 호출이 실행되기 전에 검사하는 사이드카로 실행할 수 있습니다. 통합 경로에는 실험용 Claude Code 플러그인, 사용자 정의 에이전트용 내장 가능 런타임, 에이전트 훅, Archestra를 통한 프록시 수준 사용이 포함됩니다. README는 Archestra의 릴리스 후보가 Claude Code, Claude Desktop, Cursor, Codex, OpenCode, Copilot CLI, n8n, 그리고 LLM 프록시를 통해 통신하는 에이전트를 지원한다고 밝힙니다. 정책 개발을 위해 APPA CLI는 구성 검증용 `appa describe --check`와 스크립트된 도구 호출을 예상 결정과 대조하는 `appa replay`를 제공합니다. 이러한 검사는 로컬에서 실행하거나 CI에 추가할 수 있습니다. 이 프로젝트는 표준 및 적대적 프롬프트를 포함한 Bench-Corp와 AgentThreatBench에 대한 평가를 보고합니다. 공개된 결과는 1,320회 평가에서 점수화된 공격이 성공하지 못했고 작업 완료율은 88–90%였다고 주장하며, Microsoft FIDES 및 Claude Code 자동 모드와의 비교도 제시됩니다. 이는 여기서 독립적으로 검증된 결론이 아니라 프로젝트가 보고한 벤치마크 결과입니다. OpenAPPA는 프리뷰이자 RFC로 표시됩니다. README는 구성과 와이어 인터페이스가 호환성 심 없이 변경될 수 있다고 경고합니다. 형식적 대수와 복구 보장은 NeurIPS 2026 워크숍에 채택된 논문에서 설명됩니다. 저장소는 MIT 라이선스입니다.