Merci d'avoir envoyé votre demande ! Un membre de notre équipe vous contactera sous peu.
Merci d'avoir envoyé votre réservation ! Un membre de notre équipe vous contactera sous peu.
Plan du cours
Fondamentaux de l’exploitation du cloud sur AWS
- Rôles et responsabilités opérationnels dans le cloud
- Services opérationnels de base : CloudWatch, CloudTrail, AWS Config
Infrastructure as Code et provisionnement
- Principes de l’IaC et infrastructure immuable
- Provisionnement avec Terraform et AWS CloudFormation
- Gestion de l’état, des modules et de la promotion d’environnements
CI/CD et stratégies de déploiement
- Conception de pipelines CI/CD pour les applications cloud-native
- Déploiements blue/green, canary et glissants
- Automatisation du rollback, des vérifications d’intégrité et de la validation des releases
Surveillance, observabilité et alertes
- Métriques, journaux et traces : envoi, stockage et analyse
- Utilisation de CloudWatch, X-Ray et d’outils d’observabilité tiers
- Définition des SLO/SLI, des politiques d’alerte et des pratiques d’appel de garde
Exploitation de la sécurité et gestion des identités
- Meilleures pratiques IAM, principe du moindre privilège et accès inter-comptes
- Gestion des secrets, KMS et stockage sécurisé des paramètres
- Sécurité opérationnelle : stratégies de correctifs, analyse de vulnérabilités et journaux d’audit
Résilience, sauvegarde et reprise d’activité
- Conception pour la tolérance aux pannes et la haute disponibilité
- Stratégies de sauvegarde, automatisation des instantanés et procédures de restauration
- Planification de la reprise d’activité et création de runbooks
Optimisation des coûts et gouvernance
- Visibilité des coûts : facturation, étiquetage et stratégies d’allocation des coûts
- Ajustement de la taille des instances, instances réservées/plans d’économies et contrôles budgétaires
- Gouvernance : politiques, garde-fous et automatisation pour la conformité
Conteneurs, serverless et exploitation de l’exécution
- Considérations opérationnelles pour ECS, EKS et Lambda
- Découverte de services, redimensionnement automatique et limites de ressources
- Journalisation, traçage et débogage des charges de travail conteneurisées
Réponse aux incidents, playbooks et ingénierie du chaos
- Réponse aux incidents basée sur des runbooks et pratiques de post-mortem
- Automatisation de la remédiation et modèles d’auto-guérison
- Introduction aux expériences de chaos pour valider la résilience
Atelier pratique : Exploiter une charge de travail d’exemple
- Déployer une application d’exemple à l’aide de l’IaC et d’un pipeline CI/CD
- Mettre en œuvre la surveillance, les alertes et un script de remédiation automatisé
- Simuler des incidents et pratiquer la réponse basée sur des runbooks
Résumé et prochaines étapes
Pré requis
- Une compréhension de base des concepts cloud et du réseau
- Une familiarité avec la ligne de commande Linux et le scripting
- Une expérience avec la gestion de sources (Git) et les concepts de base du CI/CD
Public cible
- Ingénieurs d’exploitation cloud
- SRE et ingénieurs plateforme
- Ingénieurs DevOps et chefs d’équipe technique
21 Heures
Nos clients témoignent (1)
La convivialité tout en apprenant