このプロジェクトについて

AgentLeakは、AIエージェント専用に設計されたオープンソースのプライバシーテストフレームワークです。エージェントの最終出力は問題なく見える一方で、ツール呼び出し、共有メモリ、エージェント間メッセージ、ログなどの内部チャネルを通じて機密データが漏洩するという重大なセキュリティギャップに取り組みます。このツールは完全にローカルで動作し、ユーザーのマシンからデータが流出することはなく、コア分析にクラウドサービスやLLM依存は不要です。 主な機能は以下の通りです: **マルチチャネル検出:** AgentLeakは、`user_input`、`final_output`、`inter_agent_message`、`shared_memory`、`tool_call`、`tool_response`、`log`、`generated_file`の8つの正規化されたチャネルを検査します。この包括的なカバレッジにより、出力のみを監査する従来の方法では見逃される漏洩を検出できます。 **決定的スコアリング(AgentRisk):** 漏洩はAgentRiskフレームワークを使用してスコアリングされます。これは、GDPR第9条とケベック州法25に基づく、深刻度重み付け、密度正規化されたリスク指数です。このシステムは、シークレットを4段階の分類法(L1-L4)で評価し、0から1の間のリスク指数(RI)を計算し、グローバルおよびチャネルごとのメトリクスを提供します。 **統合とインターフェース:** このツールは、Python SDK、CLI、ローカルWeb UI(Reactとshadcn/uiで構築)を提供します。LangChain、LangGraph、CrewAI、AutoGen、OpenAI Swarm、LlamaIndexなど、幅広いエージェントフレームワークをサポートしています。統合は、`agentleak.watch()`コンテキストマネージャーまたは特定のフレームワークコールバックを使用して簡素化されます。 **レッドチームとコンプライアンス:** AgentLeakには、敵対的テスト用の実行可能なプラグインを備えたレッドチームモジュールが含まれており、攻撃を観測可能なクラスにマッピングします。また、GDPR、HIPAA、PCI-DSS、EU AI法など14の主要フレームワークへのコンプライアンスマッピングを提供し、実行中にどのコントロールがリスクにさらされているかをユーザーが特定するのに役立ちます。 **プライバシー保証:** 検出とスコアリングは100%ローカルです。レポートはデフォルトでマスクされた値を表示し、明示的にオプトインしない限り、生のトレースは保存されません。このツールは、NER用のPresidioや文脈上の漏洩用のLLM-judgeなどのオプションの検出器をサポートしていますが、これらは任意であり、厳格なローカルプライバシーを維持するように設定できます。