このプロジェクトについて
iFixAiは、AIエージェントの独立した監査を行うフレームワークであり、運用保証と敵対的テストに重点を置いている。レイテンシやトークン効率などの技術的指標に焦点を当てる従来の観測可能ツールとは異なり、iFixAiはエージェントが意図された業務役割を果たしているかどうかを評価する。
このツールは、Fabrication(捏造)、Manipulation(操作)、Deception(欺瞞)、Unpredictability(予測不能性)、Opacity(不透明性)の5つの主要柱に基づいてエージェントを評価し、AからFまでの文字グレードを割り当てる。さらに、サボタージュやシステムリスクなどの13の追加カテゴリを含むプレミアムティアも用意されており、より深層分析が可能である。
主な機能:
- 複数の実行モード: ガイド付きCLIウィザード、CI/CD自動化向けの明示的なCLIフラグ、Claude Code、Cursor、VS Codeなどのエージェント用ネイティブプラグイン/スキル。
- 独立審査: 自己採点バイアスを回避するため、2つ目の独立したAIプロバイダーを審査役として活用できる「引用可能な」グレードをサポート。
- 柔軟な統合: OpenAI互換HTTPエンドポイント経由で、生のモデルAPIまたは実際にデプロイされたエージェントをテスト可能。
- カスタマイズ可能なテストスイート: スモーク、戦略、コア、拡張、すべての各レベルのスイートを提供。
- 包括的なレポート: JSONおよびMarkdown形式で結果を生成し、詳細なスコアカードを含む。
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.