← Retour au catalogue
Observabilité, Automatisation & SRE
Observabilité : métriques, journaux et traces
Intermédiaire
Atelier pratique
105 min
+180 pts
Construire une supervision qui détecte avant le client, avec des alertes actionnables.
Objectifs pédagogiques
- Distinguer supervision, observabilité et alerting
- Écrire des alertes basées sur les symptômes, pas les causes
- Réduire le bruit et la fatigue d'alerte
Programme détaillé
- 1Les trois piliers et leurs limitesDistinguer métriques, journaux et traces, et comprendre pourquoi leur addition ne fait pas automatiquement de l'observabilité.25 min
- 2Alerting actionnable et seuils intelligentsConcevoir des alertes basées sur les symptômes visibles par l'utilisateur plutôt que sur les causes internes.35 min
- 3Atelier : refondre un jeu d'alertes bruyantAuditer un jeu d'alertes existant, identifier le bruit et le reconstruire autour de SLO actionnables.45 min
Règle de complétion : Rendre l'exercice pratique
Sources officielles du programme
Ce cours s'appuie exclusivement sur des référentiels publiés. Les liens renvoient vers l'éditeur officiel.
- GoogleGuide publicAccès gratuit
Site Reliability Engineering (livres en accès libre)
SLO, budgets d'erreur, gestion des astreintes et post-mortems sans blâme.
Consulter la source - CNCF / KubernetesGuide publicAccès gratuit
Documentation Kubernetes et paysage CNCF
Documentation officielle libre pour l'orchestration de conteneurs.
Consulter la source - ANSSIGuide publicAccès gratuit
Guides et recommandations de sécurité
Hygiène informatique, sécurisation des administrations système, journalisation.
Consulter la source