このプロジェクトについて

Agent Integrity Protocol(AIP)は、AIエージェントがアクションを実行する前に、その推論(思考ブロック)を評価するためのリアルタイム分析フレームワークです。LLM応答から思考コンテンツを抽出し(Anthropic、OpenAI、Google、および正規表現フォールバックをサポート)、分析LLMを使用してアライメントカードに照らして評価し、整合性の判定(clear、review_needed、boundary_violation)を返すことで、ターン間の介入を可能にします。このプロトコルには、プロバイダーアダプター、ドリフト検出のためのセッションウィンドウ処理、および境界値と恐怖値を評価基準として注入する良心プロンプトシステムが含まれています。これは、事後検証ではなくリアルタイム検出を提供する、遡及的エージェントアライメントプロトコル(AAP)を補完するものとして位置付けられています。リポジトリには、PythonおよびTypeScript SDK、仕様、例(基本チェック、ゲートウェイ統合、敵対的シナリオ)が含まれ、ISO/IEC 42001、IEEE 7001、EU AI法などの標準への準拠を主張しています。また、インジェクションを防止しない、ストリームを中断しない、モデルが思考ブロックを公開することに依存する、という制限を明示的に述べています。