Об этом проекте
AgentLeak — это среда тестирования конфиденциальности с открытым исходным кодом, специально разработанная для ИИ-агентов. Она решает критическую проблему безопасности, когда конечный вывод агента выглядит чистым, но чувствительные данные утекают через внутренние каналы, такие как вызовы инструментов, общая память, сообщения между агентами и журналы. Инструмент работает полностью локально, гарантируя, что данные не покидают машину пользователя, и не требует облачных сервисов или зависимостей от LLM для своего основного анализа.
Ключевые функции включают:
**Многоканальное обнаружение:** AgentLeak проверяет восемь нормализованных каналов: `user_input`, `final_output`, `inter_agent_message`, `shared_memory`, `tool_call`, `tool_response`, `log` и `generated_file`. Такое всестороннее покрытие позволяет обнаруживать утечки, которые пропускают традиционные проверки, основанные только на выводе.
**Детерминированная оценка (AgentRisk):** Утечки оцениваются с помощью фреймворка AgentRisk, индекса риска с весовой важностью и нормализацией по плотности, основанного на ст. 9 GDPR и законе Квебека № 25. Система классифицирует секреты по четырехуровневой таксономии (L1-L4) и вычисляет индекс риска (RI) от 0 до 1, предоставляя как глобальные, так и поканальные метрики.
**Интеграции и интерфейсы:** Инструмент предлагает Python SDK, CLI и локальный веб-интерфейс (построенный на React и shadcn/ui). Он поддерживает широкий спектр фреймворков для агентов, включая LangChain, LangGraph, CrewAI, AutoGen, OpenAI Swarm, LlamaIndex и другие. Интеграция упрощается с помощью менеджера контекста `agentleak.watch()` или специальных колбэков фреймворка.
**Red Teaming и соответствие требованиям:** AgentLeak включает модуль Red Team с исполняемыми плагинами для adversarial-тестирования, сопоставляя атаки с наблюдаемыми классами. Он также предоставляет сопоставление с 14 основными фреймворками, такими как GDPR, HIPAA, PCI-DSS и EU AI Act, помогая пользователям определить, какие меры контроля находятся под угрозой во время выполнения.
**Гарантии конфиденциальности:** Обнаружение и оценка выполняются на 100% локально. Отчеты по умолчанию показывают замаскированные значения, а необработанные трассировки не сохраняются, если пользователь явно не согласится на это. Инструмент поддерживает дополнительные детекторы, такие как Presidio для NER и LLM-judge для контекстных утечек, но они необязательны и могут быть настроены для строгого соблюдения локальной конфиденциальности.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.