这个项目能做什么

OpenAPPA 是置于 AI 智能体与其工具之间的策略执行层。在每个动作之前,它回答所涉数据是否被允许前往请求的目标。运行时追踪智能体所读取信息的敏感度和信任度,并将该历史应用于后续工具调用,目标是防止敏感数据到达未授权的工具。 该系统使用 APPA,即 Agentic Permissions Policy Algebra,策略以声明式 TOML 编写。根据 README,决策仅由事件日志产生,引擎在评估期间不进行网络或文件调用,因此同一日志应能重复产生相同决策。它可嵌入进程内运行,也可作为边车运行,在调用执行前进行检查。 集成路径包括用于实验的 Claude Code 插件、用于自定义的可嵌入运行时、智能体钩子,以及通过 Archestra 在代理层使用。README 指出,Archestra 的候选发布版支持 Claude Code、Claude Desktop、Cursor、Codex、OpenCode、Copilot CLI、n8n,以及通过 LLM 代理接入的智能体。 在策略开发方面,APPA CLI 提供 `appa describe --check` 用于配置验证,以及 `appa replay` 用于按预期决策检查脚本化工具调用。这些检查可在本地运行,也可加入 CI。 该项目报告了在 Bench-Corp 和 AgentThreatBench 上的评估,包括标准提示和对抗性提示。其公布结果声称,在 1,320 次评估中没有已计分攻击成功,同时任务完成率为 88–90%;还给出了与 Microsoft FIDES 和 Claude Code 自动模式的比较。这些是项目报告的基准结果,此处并非独立验证的结论。 OpenAPPA 被标记为预览版和 RFC。README 警告配置和通信接口可能发生变化,且不提供兼容性垫片。形式化代数与恢复保证在一篇被 NeurIPS 2026 研讨会接收的论文中描述。该仓库采用 MIT 许可。