Krkn Operator — это Kubernetes-нативная платформа для централизованного многовкластерного инжиниринга хаоса, позволяющая командам оркестрировать и управлять хаос-экспериментами в кластерах Kubernetes и OpenShift из единой плоскости управления.
Открытый код. Новые возможности.
Находите качественные проекты с открытым исходным кодом, отправляйте проекты анонимно, заявляйте права на свои проекты и редактируйте их.
Немного любопытства. Мир открытого кода.
THE FIRST COLLECTIONopenstatus — это открытая платформа мониторинга доступности и статус-страниц, построенная вокруг инфраструктуры как кода. Мониторы, статус-страницы и каналы уведомлений описываются в YAML или Terraform, применяются через CLI или CI и управляются через API, MCP-сервер или ИИ-ассистенты. Доступны 28 глобальных регионов проверки, коммуникация об инцидентах и варианты самостоятельного размещения.
Большая коллекция открытого кода из 2624 вопросов для собеседований и практических упражнений по DevOps и SRE, охватывающая Linux, Kubernetes, Terraform, AWS, Azure, GCP, Docker, Ansible, CI/CD, сети, базы данных, наблюдаемость и другое.
Курируемая база знаний по практике SRE от ведущих технологических компаний, включая Airbnb, Netflix, Google и других. Содержит посты, доклады, видео и книги по культуре, мониторингу, инцидентам, хаос-инжинирингу и автоматизации.
Atlantis — это инструмент автоматизации pull-запросов для Terraform с self-hosted развертыванием, который обеспечивает совместную работу над инфраструктурой как кодом.
aiHelpDesk — система управляемых ИИ-агентов для инцидент-менеджмента и устранения неполадок на продакшн-базах данных. Поддерживает VM, Docker/Podman и Kubernetes, предоставляет аудит, гейтки одобрения и сертификацию стабильности.
Pulse — стартер наблюдаемости для Spring Boot «всё включено»: файрвол кардинальности, распространение бюджета тайм-аутов, SLO-as-code, асинхронный контекст, маскирование PII и стабильные отпечатки ошибок — без агентов и с одной зависимостью.
Подборка ресурсов для подготовки к собеседованию на позицию Site Reliability Engineer (SRE): Linux, сети, контейнеры, Kubernetes, базы данных, проектирование систем, мониторинг, инцидент-процессы и вопросы для интервью.