O Krkn Operator é uma plataforma nativa Kubernetes para engenharia de caos multi-cluster centralizada, permitindo orquestrar e gerenciar experimentos de caos em clusters Kubernetes e OpenShift a partir de um único plano de controle.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONopenstatus é uma plataforma open-source de monitoramento de uptime e páginas de status baseada em infraestrutura como código. Monitores, páginas de status e canais de notificação são declarados em YAML ou Terraform, aplicados via CLI ou CI, e gerenciados por API, servidor MCP ou assistentes de IA. Oferece 28 regiões globais de verificação, comunicação de incidentes e opções de auto-hospedagem.
Uma grande coleção de código aberto com 2624 perguntas e exercícios práticos de DevOps e SRE, abrangendo Linux, Kubernetes, Terraform, AWS, Azure, GCP, Docker, Ansible, CI/CD, redes, bancos de dados, observabilidade e mais.
Repositório curado de práticas, ferramentas e cultura de SRE de grandes empresas como Airbnb, Netflix, Google e outras.
Atlantis é uma ferramenta de automação de pull requests do Terraform auto-hospedada que permite fluxos de trabalho colaborativos de infraestrutura como código.
aiHelpDesk é um sistema governado por agentes de IA para resposta e resolução de incidentes em bancos de dados de produção, oferecendo injeção de falhas, operações em frota, playbooks auditáveis e certificação de estabilidade.
O Pulse é um starter de observabilidade Spring Boot completo, que oferece firewall de cardinalidade, propagação de orçamento de timeout, SLO-as-code, contexto assíncrono, mascaramento de PII e impressões digitais estáveis de erros, sem agentes e com uma única dependência.
Uma coleção selecionada de recursos para preparação para entrevistas de Site Reliability Engineer (SRE), abrangendo Linux, redes, contêineres, Kubernetes, bancos de dados, design de sistemas, monitoramento, processos de incidentes e perguntas de entrevista.