Métriques, tableaux de bord et SLI/SLO
Transformez les données brutes de supervision en métriques et tableaux de bord pertinents, puis définissez des indicateurs et objectifs de niveau de service pour mesurer la fiabilité qui compte réellement pour les utilisateurs.
Métriques, tableaux de bord et SLI/SLO est une leçon DevOps Bootcamp gratuite sur CoddyKit. Ceci est la leçon 4 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage DevOps Bootcamp, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours DevOps Bootcamp comprend 4 leçons au total.
Des données aux informations utiles
La collecte des métriques n’est que la première étape. Pour exploiter des systèmes fiables, vous devez transformer les chiffres en tableaux de bord et en objectifs au niveau du service qui reflètent l’expérience réelle des utilisateurs.
Les quatre signaux essentiels
Google SRE recommande de surveiller quatre signaux pour tout service : la latence, le trafic, les erreurs et la saturation. Ils couvrent la plupart des problèmes visibles par les utilisateurs.
Types de métriques
Formes courantes de métriques : un compteur ne fait qu’augmenter (requêtes traitées), une jauge monte et descend (mémoire utilisée) et un histogramme répartit les valeurs par intervalles (durées des requêtes).
Interroger les métriques
Les bases de données de séries temporelles comme Prometheus utilisent un langage d’interrogation pour analyser les métriques. Ici, nous calculons le débit de requêtes par seconde sur cinq minutes.
rate(http_requests_total[5m])Créer un tableau de bord
Des outils comme Grafana transforment les requêtes en panneaux. Un bon tableau de bord répond à une question en un coup d’œil : le service fonctionne-t-il correctement en ce moment ?
- Première ligne : signaux essentiels
- Panneaux d’analyse détaillée en dessous
- Plage temporelle cohérente
Qu’est-ce qu’un SLI ?
Un indicateur de niveau de service est une valeur mesurée qui reflète la satisfaction des utilisateurs, par exemple la proportion de requêtes traitées rapidement et avec succès.
sum(rate(http_requests_total{code!~"5.."}[5m]))
/
sum(rate(http_requests_total[5m]))Qu’est-ce qu’un SLO ?
Un objectif de niveau de service est une cible définie pour un SLI sur une période donnée : par exemple, 99,9 % des requêtes doivent aboutir sur 30 jours. Il définit le niveau considéré comme suffisamment bon.
SLA ou SLO
Un SLA est une promesse contractuelle faite aux clients, souvent assortie de pénalités. Les SLO sont vos objectifs d’ingénierie internes, généralement plus stricts.
Budgets d’erreurs
Si votre SLO est de 99,9 %, les 0,1 % restants constituent votre budget d’erreurs : la marge de défaillance que vous pouvez vous permettre. Utilisez-la pour des déploiements risqués ; lorsqu’elle est épuisée, ralentissez et stabilisez le système.
Alerter sur les symptômes, pas sur les causes
Alertez les personnes sur ce que ressentent les utilisateurs (taux d’erreurs élevé, réponses lentes), et non sur chaque variation du CPU. Les alertes fondées sur les symptômes réduisent le bruit et la fatigue.
Éviter la prolifération des tableaux de bord
Avoir trop de tableaux de bord est aussi problématique que n’en avoir aucun. Conservez un petit ensemble de tableaux de bord fiables, dont la responsabilité est clairement attribuée et qui sont liés à vos SLO, plutôt que des dizaines de tableaux obsolètes.
Vérification rapide
Quel est le lien entre les SLO et les budgets d’erreurs ?
Récapitulatif
Vous savez maintenant donner du sens à la supervision :
- Surveillez les quatre signaux essentiels
- Comprenez les compteurs, les jauges et les histogrammes ; interrogez-les avec rate()
- Définissez des SLI (mesurés) et des SLO (cibles)
- Les budgets d’erreurs guident le rythme des déploiements ; alertez sur les symptômes
La fiabilité devient quelque chose que vous mesurez et orientez, plutôt qu’une simple qualité espérée.
Questions Fréquemment Posées
La leçon « Métriques, tableaux de bord et SLI/SLO » est-elle gratuite ?
Oui — le texte complet de « Métriques, tableaux de bord et SLI/SLO » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours DevOps Bootcamp, passe à CoddyKit PRO. Le cours DevOps Bootcamp comprend 4 leçons au total.
Qu'est-ce que j'apprendrai dans « Métriques, tableaux de bord et SLI/SLO » ?
Transformez les données brutes de supervision en métriques et tableaux de bord pertinents, puis définissez des indicateurs et objectifs de niveau de service pour mesurer la fiabilité qui compte réell… Tu pratiques DevOps Bootcamp avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.
Dois-je avoir de l'expérience pour commencer DevOps Bootcamp ?
Aucune expérience préalable n'est requise. DevOps Bootcamp sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 4 sur 4.
Combien de temps prend la leçon « Métriques, tableaux de bord et SLI/SLO » ?
La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.
Peux-tu écrire et exécuter du code dans cette leçon DevOps Bootcamp ?
Oui. Chaque leçon DevOps Bootcamp inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.
Toutes les leçons de ce cours
- Introduction à la supervision
- Solutions de journalisation centralisée
- Alertes et réponse aux incidents
- Métriques, tableaux de bord et SLI/SLO