Krkn Operator est une plateforme Kubernetes-native pour l'ingénierie du chaos multi-clusters centralisée, permettant aux équipes d'orchestrer et de gérer des expériences de chaos sur des clusters Kubernetes et OpenShift à partir d'un plan de contrôle unique.
Code ouvert. Horizons nouveaux.
Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.
Un peu de curiosité. Un monde de code ouvert.
THE FIRST COLLECTIONopenstatus est une plateforme open-source de surveillance de disponibilité et de pages de statut, fondée sur l'infrastructure en tant que code. Les moniteurs, pages et canaux de notification sont déclarés en YAML ou Terraform, appliqués via CLI ou CI, et gérés par API, serveur MCP ou assistants IA. Elle propose 28 régions de vérification, communication d'incident et auto-hébergement.
Une vaste collection open-source de 2624 questions et exercices pratiques DevOps et SRE, couvrant Linux, Kubernetes, Terraform, AWS, Azure, GCP, Docker, Ansible, CI/CD, réseaux, bases de données, observabilité, etc.
How They SRE est une collection curée de ressources publiques sur l'ingénierie de la fiabilité du site (SRE) provenant d'entreprises technologiques majeures comme Airbnb, Netflix et Google.
Atlantis est un outil d'automatisation des pull requests Terraform auto-hébergé qui permet des flux de travail collaboratifs d'infrastructure-as-code.
aiHelpDesk est une couche de responsabilité pour les équipes utilisant des agents IA sur des bases de données de production. Il diagnostique les incidents, propose des remédiations et exécute des correctifs sur VM, serveurs bare metal, conteneurs Docker/Podman ou clusters Kubernetes, avec approbation et audit.
Pulse est un starter d'observabilité Spring Boot complet, offrant pare-feu de cardinalité, propagation de budget de délai, SLO-as-code, contexte asynchrone, masquage PII et empreintes d'erreurs stables, sans agent et avec une seule dépendance. Compatible Java 21/25, Spring Boot 4.0+, GraalVM, avec tableaux de bord Grafana et faible surcharge.
Une collection organisée de ressources pour préparer les entretiens de Site Reliability Engineer (SRE), couvrant Linux, les réseaux, les conteneurs, Kubernetes, les bases de données, la conception de systèmes, la supervision, les processus d'incident et les questions d'entretien.