Metriche, dashboard e SLI/SLO
Trasformi i dati grezzi di monitoraggio in metriche e dashboard significative e definisca Service Level Indicator e Objective per misurare l'affidabilità che interessa davvero agli utenti.
Metriche, dashboard e SLI/SLO è una lezione DevOps Bootcamp gratuita su CoddyKit. Questa è la lezione 4 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento DevOps Bootcamp, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso DevOps Bootcamp include 4 lezioni in totale.
Dai dati agli insight
Raccogliere metriche è solo il primo passo. Per gestire sistemi affidabili dovete trasformare i numeri in dashboard e obiettivi a livello di servizio che riflettano la reale esperienza degli utenti.
I quattro segnali d'oro
Google SRE consiglia di monitorare quattro segnali per ogni servizio: latenza, traffico, errori e saturazione. Coprono la maggior parte dei problemi che interessano gli utenti.
Tipi di metriche
Formati comuni delle metriche: un contatore aumenta soltanto (richieste servite), un gauge sale e scende (memoria in uso) e un istogramma raggruppa i valori in intervalli (durate delle richieste).
Interrogare le metriche
I database di serie temporali come Prometheus usano un linguaggio di interrogazione per analizzare le metriche. Qui calcoliamo il tasso di richieste al secondo nell'arco di cinque minuti.
rate(http_requests_total[5m])Creare una dashboard
Strumenti come Grafana trasformano le query in pannelli. Una buona dashboard risponde a una domanda a colpo d'occhio: il servizio è in buone condizioni in questo momento?
- Riga superiore: segnali d'oro
- Pannelli di approfondimento sotto
- Intervallo di tempo coerente
Che cos'è un SLI?
Un indicatore del livello di servizio è un valore misurato che riflette la soddisfazione degli utenti, ad esempio la frazione di richieste gestite correttamente e rapidamente.
sum(rate(http_requests_total{code!~"5.."}[5m]))
/
sum(rate(http_requests_total[5m]))Che cos'è un SLO?
Un obiettivo del livello di servizio è un traguardo per un SLI durante un determinato intervallo: ad esempio, il 99,9% delle richieste deve avere esito positivo nell'arco di 30 giorni. Definisce che cosa si intende per qualità sufficiente.
SLA e SLO
Un SLA è una promessa contrattuale fatta ai clienti, spesso accompagnata da penali. Gli SLO sono gli obiettivi tecnici interni, generalmente più rigorosi.
Budget di errore
Se il vostro SLO è del 99,9%, il restante 0,1% costituisce il vostro budget di errore, cioè la quota di errori che potete permettervi. Usatela per deploy rischiosi; quando si esaurisce, rallentate e stabilizzate il sistema.
Create alert sui sintomi, non sulle cause
Attivate alert per gli operatori in base a ciò che percepiscono gli utenti, come un'elevata percentuale di errori o risposte lente, non per ogni variazione della CPU. Gli alert basati sui sintomi riducono il rumore e l'affaticamento.
Evitate la proliferazione delle dashboard
Avere troppe dashboard è dannoso quanto non averne nessuna. Mantenete un piccolo insieme di dashboard affidabili, gestite da responsabili chiari e collegate ai vostri SLO, invece di accumularne decine obsolete.
Verifica rapida
Qual è la relazione tra SLO e budget di errore?
Riepilogo
Ora potete dare un significato concreto al monitoraggio:
- Monitorate i quattro segnali d'oro
- Comprendete contatori, gauge e istogrammi; interrogate le metriche con rate()
- Definite gli SLI (valori misurati) e gli SLO (obiettivi)
- I budget di errore guidano il ritmo dei deploy; create alert sui sintomi
L'affidabilità diventa qualcosa da misurare e gestire, non un risultato da affidare alla speranza.
Impara DevOps Bootcamp con un tutor IA — gratis
Scrivi ed esegui vero codice nel tuo browser, ricevi aiuto istantaneo da un tutor IA disponibile 24/7, e riprendi da dove hai lasciato sul web o nell'app.
- Corsi
- 142
- Lezioni
- 568
Domande Frequenti
La lezione «Metriche, dashboard e SLI/SLO» è gratuita?
Sì — il testo completo di «Metriche, dashboard e SLI/SLO» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso DevOps Bootcamp, passa a CoddyKit PRO. Il corso DevOps Bootcamp include 4 lezioni in totale.
Cosa imparerò in «Metriche, dashboard e SLI/SLO»?
Trasformi i dati grezzi di monitoraggio in metriche e dashboard significative e definisca Service Level Indicator e Objective per misurare l'affidabilità che interessa davvero agli utenti. Eserciti DevOps Bootcamp con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.
Ho bisogno di esperienza per iniziare DevOps Bootcamp?
Non è richiesta alcuna esperienza precedente. DevOps Bootcamp su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 4 di 4.
Quanto tempo richiede la lezione «Metriche, dashboard e SLI/SLO»?
La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.
Posso scrivere ed eseguire codice in questa lezione DevOps Bootcamp?
Sì. Ogni lezione DevOps Bootcamp include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.
Tutte le lezioni di questo corso
- Introduzione al monitoraggio
- Soluzioni di logging centralizzato
- Alerting e risposta agli incidenti
- Metriche, dashboard e SLI/SLO