Plan du cours
Antipatterns SRE
- Identification des pratiques contre-productives
- Reconnaissance de l'impact des antipatterns sur la fiabilité
- Meilleures pratiques et alternatives correctives
Les SLO comme indicateur de la satisfaction client
- Définition des indicateurs de niveau de service (SLI) et des objectifs de niveau de service (SLO)
- Gestion des budgets d'erreurs et équilibre entre innovation et fiabilité
- Compréhension des limites des systèmes distribués
Conception de systèmes sécurisés et fiables
- Conception pour la tolérance aux pannes et la résilience
- Intégration de la sécurité dans l'ingénierie de la fiabilité
- Stratégies de scalabilité et de protection des données
Télémétrie complète (Full-stack Observability)
- Instrumentation et collecte de métriques
- Suivi distribué et surveillance synthétique
- Développement guidé par la télémétrie
Ingénierie des plateformes et AIOps
- Approches d'ingénierie centrées sur la plateforme
- Automatisation et orchestration dans le cadre SRE
- Exploitation de DataOps et de l'intelligence opérationnelle
Gestion des incidents en SRE
- Rôles et responsabilités dans la réponse aux incidents
- Application de cadres tels que OODA
- Remédiation automatisée et résolution assistée par IA/ML
Génie du chaos
- Principes et stratégies de test de résilience
- Planification et exécution d'exercices de « game day »
- Apprentissage à partir d'expériences de défaillance contrôlées
Le SRE comme forme pure du DevOps
- Intégration du SRE dans les flux de travail DevOps
- Alignement culturel et pratiques de collaboration
- Promotion de la transformation organisationnelle par le SRE
Exercices post-cours
- Études de cas sur la conception de systèmes à grande échelle
- Scénarios avancés d'instrumentation et de surveillance
- Résolution de problèmes de fiabilité du monde réel
Révision et préparation à l'examen
- Révision finale du syllabus DevOps Institute SRE Practitioner
- Questions d'exemple et examens pratiques
- Stratégies de gestion de l'examen et recommandations
Synthèse et prochaines étapes
Pré requis
- Compréhension des principes fondamentaux du Site Reliability Engineering (SRE)
- Expérience des pratiques DevOps et des outils associés
- Connaissance de la surveillance des systèmes, de la gestion des incidents et de l'automatisation
Public cible
- Professionnels SRE recherchant la certification DevOps Institute SRE Practitioner
- Ingénieurs DevOps souhaitant s'orienter vers des rôles centrés sur la fiabilité
- Responsables des opérations chargés de la stratégie et de l'exécution de la fiabilité
Nos clients témoignent (2)
Craig était très impliqué dans la formation, toujours en s'assurant que nous prêtions attention, en adaptant les exemples à nos activités quotidiennes et en fournissant une réponse chaque fois qu'on lui posait une question, même si l'information n'était pas incluse dans la présentation.
Ecaterina Ioana Nicoale - BOOKING HOLDINGS ROMANIA SRL
Formation - DevOps Foundation®
Traduction automatique
Niveau élevé d’engagement et de connaissances du formateur
Jacek - Softsystem
Formation - DevOps Engineering Foundation (DOEF)®
Traduction automatique