这个项目能做什么
AgentLeak 是一个专为 AI 代理设计的开源隐私测试框架。它解决了关键的安全漏洞:代理的最终输出看似干净,但敏感数据可能通过内部渠道泄露,如工具调用、共享内存、代理间消息和日志。该工具完全在本地运行,确保数据不会离开用户机器,其核心分析无需云服务或 LLM 依赖。
主要功能包括:
**多通道检测:** AgentLeak 检查八个标准化通道:`user_input`、`final_output`、`inter_agent_message`、`shared_memory`、`tool_call`、`tool_response`、`log` 和 `generated_file`。这种全面覆盖使其能够检测传统仅输出审计遗漏的泄露。
**确定性评分(AgentRisk):** 泄露使用 AgentRisk 框架评分,这是一个基于 GDPR 第 9 条和魁北克省第 25 号法律的严重性加权、密度归一化风险指数。系统将机密分为四级分类(L1-L4),并计算 0 到 1 之间的风险指数(RI),提供全局和每通道指标。
**集成与接口:** 该工具提供 Python SDK、CLI 和本地 Web UI(基于 React 和 shadcn/ui 构建)。它支持多种代理框架,包括 LangChain、LangGraph、CrewAI、AutoGen、OpenAI Swarm、LlamaIndex 等。通过 `agentleak.watch()` 上下文管理器或特定框架回调简化集成。
**红队与合规:** AgentLeak 包含一个红队模块,带有可执行插件用于对抗性测试,将攻击映射到可观察类别。它还提供对 14 个主要框架的合规映射,如 GDPR、HIPAA、PCI-DSS 和欧盟 AI 法案,帮助用户识别运行期间哪些控制措施面临风险。
**隐私保证:** 检测和评分 100% 在本地进行。报告默认显示掩码值,除非明确选择,否则不存储原始跟踪。该工具支持可选检测器,如用于 NER 的 Presidio 和用于上下文泄露的 LLM 判断器,但这些是可选的,可配置以保持严格的本地隐私。
评论
0 评分人数达到10人后显示
登录后参与讨论。