À propos du projet
How They SRE est une collection curée de ressources publiquement disponibles sur la manière dont les organisations technologiques pratiquent l'Ingénierie de la Fiabilité du Site (SRE). Le référentiel compile des articles de blog, des conférences, des vidéos et des livres provenant de plus de 100 entreprises, notamment Airbnb, Netflix, Google, Dropbox, Etsy, Shopify, Uber et bien d'autres.
Le contenu est organisé par organisation, avec des sections pliables couvrant des sujets tels que : la culture SRE et le recrutement, la surveillance et l'observabilité, les cadres d'alerte, la gestion des incidents et les post-mortems, les pratiques de garde (on-call), l'ingénierie du chaos, l'automatisation, l'ingénierie de la performance, l'ingénierie de la plateforme et les tests en production.
Chaque entrée d'organisation renvoie vers leurs blogs techniques, présentations de conférences (SREcon, Velocity, etc.) et publications. Parmi les exemples figurent la gestion automatisée des incidents chez Airbnb, l'ingénierie du chaos chez Netflix, les livres SRE de Google, l'évolution de l'infrastructure chez Dropbox et la culture des post-mortems sans blâme chez Etsy.
Le référentiel sert de référence pour les praticiens SRE, les ingénieurs de plateforme et les dirigeants techniques afin d'apprendre des pratiques réelles d'organisations fonctionnant à grande échelle. Il accepte les demandes de tirage (pull requests) pour de nouvelles contributions et inclut des flux de travail CI pour la validation.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.