Metriche, dashboard e SLI/SLO
Trasformi i dati grezzi di monitoraggio in metriche e dashboard significative e definisca Service Level Indicator e Objective per misurare l'affidabilità che interessa davvero agli utenti.
Metriche, dashboard e SLI/SLO è una lezione Docker & DevOps Fundamentals gratuita su CoddyKit. Questa è la lezione 4 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento Docker & DevOps Fundamentals, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso Docker & DevOps Fundamentals include 4 lezioni in totale.
Dai dati agli insight
Raccogliere metriche è solo il primo passo. Per gestire sistemi affidabili dovete trasformare i numeri in dashboard e obiettivi a livello di servizio che riflettano la reale esperienza degli utenti.
I quattro segnali d'oro
Google SRE consiglia di monitorare quattro segnali per ogni servizio: latenza, traffico, errori e saturazione. Coprono la maggior parte dei problemi che interessano gli utenti.
Tipi di metriche
Formati comuni delle metriche: un contatore aumenta soltanto (richieste servite), un gauge sale e scende (memoria in uso) e un istogramma raggruppa i valori in intervalli (durate delle richieste).
Interrogare le metriche
I database di serie temporali come Prometheus usano un linguaggio di interrogazione per analizzare le metriche. Qui calcoliamo il tasso di richieste al secondo nell'arco di cinque minuti.
rate(http_requests_total[5m])Creare una dashboard
Strumenti come Grafana trasformano le query in pannelli. Una buona dashboard risponde a una domanda a colpo d'occhio: il servizio è in buone condizioni in questo momento?
- Riga superiore: segnali d'oro
- Pannelli di approfondimento sotto
- Intervallo di tempo coerente
Che cos'è un SLI?
Un indicatore del livello di servizio è un valore misurato che riflette la soddisfazione degli utenti, ad esempio la frazione di richieste gestite correttamente e rapidamente.
sum(rate(http_requests_total{code!~"5.."}[5m]))
/
sum(rate(http_requests_total[5m]))Che cos'è un SLO?
Un obiettivo del livello di servizio è un traguardo per un SLI durante un determinato intervallo: ad esempio, il 99,9% delle richieste deve avere esito positivo nell'arco di 30 giorni. Definisce che cosa si intende per qualità sufficiente.
SLA e SLO
Un SLA è una promessa contrattuale fatta ai clienti, spesso accompagnata da penali. Gli SLO sono gli obiettivi tecnici interni, generalmente più rigorosi.
Budget di errore
Se il vostro SLO è del 99,9%, il restante 0,1% costituisce il vostro budget di errore, cioè la quota di errori che potete permettervi. Usatela per deploy rischiosi; quando si esaurisce, rallentate e stabilizzate il sistema.
Create alert sui sintomi, non sulle cause
Attivate alert per gli operatori in base a ciò che percepiscono gli utenti, come un'elevata percentuale di errori o risposte lente, non per ogni variazione della CPU. Gli alert basati sui sintomi riducono il rumore e l'affaticamento.
Evitate la proliferazione delle dashboard
Avere troppe dashboard è dannoso quanto non averne nessuna. Mantenete un piccolo insieme di dashboard affidabili, gestite da responsabili chiari e collegate ai vostri SLO, invece di accumularne decine obsolete.
Verifica rapida
Qual è la relazione tra SLO e budget di errore?
Riepilogo
Ora potete dare un significato concreto al monitoraggio:
- Monitorate i quattro segnali d'oro
- Comprendete contatori, gauge e istogrammi; interrogate le metriche con rate()
- Definite gli SLI (valori misurati) e gli SLO (obiettivi)
- I budget di errore guidano il ritmo dei deploy; create alert sui sintomi
L'affidabilità diventa qualcosa da misurare e gestire, non un risultato da affidare alla speranza.
Impara Docker & DevOps Fundamentals con un tutor IA — gratis
Scrivi ed esegui vero codice nel tuo browser, ricevi aiuto istantaneo da un tutor IA disponibile 24/7, e riprendi da dove hai lasciato sul web o nell'app.
- Corsi
- 12
- Lezioni
- 48
Domande Frequenti
La lezione «Metriche, dashboard e SLI/SLO» è gratuita?
Sì — il testo completo di «Metriche, dashboard e SLI/SLO» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso Docker & DevOps Fundamentals, passa a CoddyKit PRO. Il corso Docker & DevOps Fundamentals include 4 lezioni in totale.
Cosa imparerò in «Metriche, dashboard e SLI/SLO»?
Trasformi i dati grezzi di monitoraggio in metriche e dashboard significative e definisca Service Level Indicator e Objective per misurare l'affidabilità che interessa davvero agli utenti. Eserciti Docker & DevOps Fundamentals con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.
Ho bisogno di esperienza per iniziare Docker & DevOps Fundamentals?
Non è richiesta alcuna esperienza precedente. Docker & DevOps Fundamentals su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 4 di 4.
Quanto tempo richiede la lezione «Metriche, dashboard e SLI/SLO»?
La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.
Posso scrivere ed eseguire codice in questa lezione Docker & DevOps Fundamentals?
Sì. Ogni lezione Docker & DevOps Fundamentals include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.
Tutte le lezioni di questo corso
- Introduzione al monitoraggio
- Soluzioni di logging centralizzato
- Alerting e risposta agli incidenti
- Metriche, dashboard e SLI/SLO