Об этом проекте

aiHelpDesk — слой подотчётности для команд, использующих ИИ-агентов на продакшн-базах данных. Система диагностирует инциденты, предлагает устранение и выполняет исправления на виртуальных машинах, голых железяках, в контейнерах Docker/Podman или кластерах Kubernetes. Каждое значимое действие утверждается, аудируется и сертифицируется как согласованное. **Ключевые возможности:** Тестирование инъекцией отказов — внедрение 32 известных режимов сбоев (SQL-only, SSH, K8s) в staging-базу данных для оценки диагностики агента и проверки восстановления. Инструмент `faulttest` работает без доступа к кластеру. Fleet operations — координация изменений на множестве баз данных с canary-фазами, гейтами утверждения, обнаружением schema drift и полными audit trails. Planner на естественном языке преобразует запросы свободным текстом в fleet plans. Playbooks — сохранённые runbooks, сочетающие намерение с экспертными рекомендациями. Системные playbooks поставляются вместе с инструментом; пользовательские создаются, импортируются или автоматически генерируются из инцидент-трассировок. AI governance — восьмимодульная框架, включая tamper-proof audit logs, enforcement blast-radius, off-hours guards и real-time policy evaluation. Требуется утверждение человека перед любым деструктивным действием. Инцидент-диагностика — агент собирает данные со слоёв базы данных, K8s, OS и хранения в timestamped support bundle. При разрешении автоматически синтезирует черновик playbook из audit trace. **Институциональная память:** Каждый разрешённый инцидент предлагает черновик playbook; каждый успешный `faulttest` автосохраняет черновик. Операторы-люди проверяют и активируют их. Запросы свободным текстом сопоставляются с закодированными симптомами и маршрутизируются автоматически. **Сертификация стабильности:** Перед выходом playbook в live rotation он сертифицируется по трём измерениям: outcome (прошёл ли?), conclusion (достиг ли агент одинакового diagnosa при каждом прогоне?) и evaluation (согласился ли judge сам с собой?). Certificates вида `STABLE(7) attr=oom-kill (7/7)` обеспечивают аудируемое доказательство консистентного и корректного reasoning. **Архитектура:** Построен на Google ADK для Go. Expert agents (Database, Kubernetes, Sysadmin, Incident, Orchestrator) are swappable or extensible via A2A protocol. Система model-agnostic и тестирована с моделями Anthropic и Gemini. **Варианты деплоймента:** Docker/Podman, direct host installation или Kubernetes через Helm. Binaries доступны для Linux x86-64, ARM (Graviton, Ampere) и macOS (Intel и Apple Silicon). **Upstream agents:** Агенты aiHelpDesk могут вызываться людьми через Orchestrator или upstream агентами и программами через A2A protocol и Gateway REST API. Companion bots включают SREBot (observability watcher), SecBot (security responder) и GovBot (compliance reporter).