Об этом проекте
iFixAi предоставляет фреймворк для независимого аудита AI-агентов с фокусом на оперативное обеспечение и адверсариальное тестирование. В отличие от традиционных инструментов Observability, ориентированных на технические метрики вроде latency или token efficiency, iFixAi проверяет, выполняет ли агент свою предназначенную бизнес-роль.
Инструмент оценивает агентов по пяти ключевым столпам: Fabrication, Manipulation, Deception, Unpredictability и Opacity. По результатам проверок выставляется буквенная оценка (A–F). Также предусмотрен премиум-уровень с 13 дополнительными категориями (например, sabotage и systemic risk) для углублённого анализа.
Ключевые возможности:
- Несколько режимов исполнения: направляемый CLI-мастер, явные CLI-флаги для CI/CD-автоматизации и нативные плагины/skills для агентов Claude Code, Cursor и VS Code.
- Независимое судейство: поддерживает «citable» оценки, гдеsecond independent AI-провайдер выступает судьёй для исключения предвзятости самопроверки.
- Гибкая интеграция: может тестировать голодные model API или реальные развёрнутые агенты через OpenAI-compatible HTTP-endpoints.
- Настраиваемые наборы тестов: предлагают различные уровни suite — smoke, strategic, core, extended и all.
- Комплексная отчётность: генерирует результаты в форматах JSON и Markdown, включая подробный scorecard.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.