このプロジェクトについて
aiHelpDeskは、本番データベースでAIエージェントを使用するチームのための説明責任レイヤーです。インシデントを診断し、修復を提案し、VM、ベアメタル、Docker/Podmanコンテナ、またはKubernetesクラスタ全体で修正を実行します。重要なすべてのアクションは承認され、監査され、一貫していると認定されます。
主要機能:
障害注入テスト — ステージングデータベースに対して32の既知の障害モード(SQLのみ、SSH、K8s)を注入し、エージェントの診断を採点し、修復による回復を検証します。`faulttest`ツールはクラスタアクセスなしで動作します。
フリート運用 — カナリアフェーズ、承認ゲート、スキーマドリフト検出、完全な監査証跡を用いて、複数のデータベースにまたがる変更を調整します。自然言語Plannerが自由記述のリクエストをフリート計画に変換します。
プレイブック — 意図と専門家のガイダンスを組み合わせた保存済みランブック。システムプレイブックはツールに同梱されています。カスタムプレイブックは作成、インポート、またはインシデントトレースから自動生成できます。
AIガバナンス — 改ざん防止監査ログ、ブラストラディウス実施、時間外ガード、リアルタイムポリシー評価を含む8モジュールフレームワーク。破壊的なアクションの前には人間の承認が必要です。
インシデント診断 — インシデントエージェントはデータベース、K8s、OS、ストレージ層のデータをタイムスタンプ付きサポートバンドルに収集します。解決時に、監査トレースからプレイブックのドラフトを自動的に合成します。
組織的記憶: 解決されたすべてのインシデントはプレイブックのドラフトを提案します。成功したすべての`faulttest`はドラフトを自動保存します。人間のオペレーターがレビューして有効化します。自由記述クエリはエンコードされた症状と照合され、自動的にルーティングされます。
安定性認定: プレイブックが本番ローテーションに入る前に、3つの次元で認定されます。結果(合格したか?)、結論(エージェントが毎回同じ診断に到達したか?)、評価(ジャッジがそれ自体と一致したか?)。`STABLE(7) attr=oom-kill (7/7)`のような証明書は、一貫した正確な推論の監査可能な証拠を提供します。
アーキテクチャ: Google ADK for Go上に構築されています。専門エージェント(Database、Kubernetes、Sysadmin、Incident、Orchestrator)は、A2Aプロトコルを介して交換可能または拡張可能です。システムはモデル非依存で、AnthropicおよびGeminiモデルでテストされています。
デプロイオプション: Docker/Podman、ホストへの直接インストール、またはHelm経由のKubernetes。バイナリはLinux x86-64、ARM(Graviton、Ampere)、macOS(IntelおよびApple Silicon)で利用可能です。
上流エージェント: aiHelpDeskエージェントは、人間がOrchestratorを介して呼び出すか、上流エージェントやプログラムがA2AプロトコルとGateway REST APIを介して呼び出すことができます。コンパニオンボットには、SREBot(可観測性ウォッチャー)、SecBot(セキュリティレスポンダー)、GovBot(コンプライアンスレポーター)があります。
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.