프로젝트 소개

aiHelpDesk는 프로션 데이터베이스에서 AI 에이전트를 사용하는 팀을 위한 책임성 계층입니다. VM, 베어메탈, Docker/Podman 컨테이너 또는 Kubernetes 클러스터 전반에서 인시던트를 진단하고, 복구 방안을 제안하며, 수정을 실행합니다. 모든 중대한 작업은 승인되고 감사되며 일관성이 인증됩니다. **핵심 기능:** 장애 주입 테스트 — 32가지 알려진 장애 모드를 SQL 전용, SSH, K8s에 대해 스테이징 데이터베이스에 주입하여 에이전트의 진단을 채점하고 복구 조치를 검증합니다. faulttest 도구는 클러스터 접근 없이 작동합니다. 플릿 운영 — 카나리 단계, 승인 게이트, 스키마 드리프트 감지, 전체 감사 추적을 통해 여러 데이터베이스에 걸친 변경을 조정합니다. 자연어 Planner는 자유 형식 요청을 플 계획으로 변환합니다. 플레이북 — 의도와 전문가 지침을 결합한 저장된 북입니다. 시스템 플레이북은 도구와 함께 제공되며, 사용자 정의 플레이북은 작성, 가져오기 또는 인시던트 추적에서 자동 생성됩니다. AI 거버넌스 — 변조 방지 감사 로그, 블래스트 반경(blast-radius) 적용, 비업무 시간 가드, 실시간 정책 평가를 포함한 8개 모 프레임워크입니다. 파괴적인 작업 전에는 사람의 승인이 필요합니다. 인시던트 진단 — 인시던트 에이전트는 데이터베이스, K8s, OS, 스토리지 계층 데이터를 타임스프가 찍힌 지원 번들로 수집합니다. 해결 시 감사 추적에서 플레이북 초안을 자동으로 합성합니다. **조직 기억:** 해결된 모든 인시던트는 플레이북 초안을 제안하고, 성공한 모든 faulttest는 초안을 자동 저장합니다. 사람 운영자가 검토하고 활성화합니다. 자유 텍스트 리는 인코딩된 증상과 일치되어 자동 라우팅됩니다. **안정성 인증:** 플레이북이 실제 운영 순환에 들어가기 전에 세 가지 차원에서 인증됩니다: 결과(통과했는가?), 결론(에이전트가 매 실행마다 동일한 진단에 도달했는가?), 평가(판정자가 스스로와 일치했는가?). STABLE(7) attr=oom-kill (7/7)와 같은 인증서는 일관되고 올바른 추론에 대한 감사 가능한 증거를 제공합니다. **아키텍처:** Go용 Google ADK를 기반으로 구축되었습니다. 전문가 에이전트(Database, Kubernetes, Sysadmin, Incident, Orchestrator)는 A2A 프로토콜을 통해 교체하거나 확장할 수 있습니다. 시스템은 모델에 구애받지 않으며 Anthropic 및 Gemini 모델로 테스트되었습니다. **배포 옵션:** Docker/Podman, 호스트 직접 설치 또는 Helm을 통한 Kubernetes. 바이너리는 Linux x86-64, ARM(Graviton, Ampere), macOS(Intel 및 Apple Silicon)용으로 제공됩니다. **업스트림 에이전트:** aiHelpDesk 에이전트는 사람이 Orchestrator를 통해 호출하거나 업스트림 에이전트 및 프로그램이 A2A 프로토콜과 Gateway REST API를 통해 호출할 수 있습니다. 동반 봇으로는 SREBot(관측성 감시자), SecBot(보안 대응자), GovBot(규정 준수 보고자)이 있습니다.