Docker & DevOps Fundamentals · Lezione

Metriche, dashboard e SLI/SLO

Trasformi i dati grezzi di monitoraggio in metriche e dashboard significative e definisca Service Level Indicator e Objective per misurare l'affidabilità che interessa davvero agli utenti.

Lezione 4 di 413 passaggi

Metriche, dashboard e SLI/SLO è una lezione Docker & DevOps Fundamentals gratuita su CoddyKit. Questa è la lezione 4 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento Docker & DevOps Fundamentals, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso Docker & DevOps Fundamentals include 4 lezioni in totale.

Dai dati agli insight

Raccogliere metriche è solo il primo passo. Per gestire sistemi affidabili dovete trasformare i numeri in dashboard e obiettivi a livello di servizio che riflettano la reale esperienza degli utenti.

I quattro segnali d'oro

Google SRE consiglia di monitorare quattro segnali per ogni servizio: latenza, traffico, errori e saturazione. Coprono la maggior parte dei problemi che interessano gli utenti.

Tipi di metriche

Formati comuni delle metriche: un contatore aumenta soltanto (richieste servite), un gauge sale e scende (memoria in uso) e un istogramma raggruppa i valori in intervalli (durate delle richieste).

Interrogare le metriche

I database di serie temporali come Prometheus usano un linguaggio di interrogazione per analizzare le metriche. Qui calcoliamo il tasso di richieste al secondo nell'arco di cinque minuti.

rate(http_requests_total[5m])

Creare una dashboard

Strumenti come Grafana trasformano le query in pannelli. Una buona dashboard risponde a una domanda a colpo d'occhio: il servizio è in buone condizioni in questo momento?

  • Riga superiore: segnali d'oro
  • Pannelli di approfondimento sotto
  • Intervallo di tempo coerente

Che cos'è un SLI?

Un indicatore del livello di servizio è un valore misurato che riflette la soddisfazione degli utenti, ad esempio la frazione di richieste gestite correttamente e rapidamente.

sum(rate(http_requests_total{code!~"5.."}[5m]))
 /
sum(rate(http_requests_total[5m]))

Che cos'è un SLO?

Un obiettivo del livello di servizio è un traguardo per un SLI durante un determinato intervallo: ad esempio, il 99,9% delle richieste deve avere esito positivo nell'arco di 30 giorni. Definisce che cosa si intende per qualità sufficiente.

SLA e SLO

Un SLA è una promessa contrattuale fatta ai clienti, spesso accompagnata da penali. Gli SLO sono gli obiettivi tecnici interni, generalmente più rigorosi.

Budget di errore

Se il vostro SLO è del 99,9%, il restante 0,1% costituisce il vostro budget di errore, cioè la quota di errori che potete permettervi. Usatela per deploy rischiosi; quando si esaurisce, rallentate e stabilizzate il sistema.

Create alert sui sintomi, non sulle cause

Attivate alert per gli operatori in base a ciò che percepiscono gli utenti, come un'elevata percentuale di errori o risposte lente, non per ogni variazione della CPU. Gli alert basati sui sintomi riducono il rumore e l'affaticamento.

Evitate la proliferazione delle dashboard

Avere troppe dashboard è dannoso quanto non averne nessuna. Mantenete un piccolo insieme di dashboard affidabili, gestite da responsabili chiari e collegate ai vostri SLO, invece di accumularne decine obsolete.

Verifica rapida

Qual è la relazione tra SLO e budget di errore?

Riepilogo

Ora potete dare un significato concreto al monitoraggio:

  • Monitorate i quattro segnali d'oro
  • Comprendete contatori, gauge e istogrammi; interrogate le metriche con rate()
  • Definite gli SLI (valori misurati) e gli SLO (obiettivi)
  • I budget di errore guidano il ritmo dei deploy; create alert sui sintomi

L'affidabilità diventa qualcosa da misurare e gestire, non un risultato da affidare alla speranza.

Gratis per iniziare

Impara Docker & DevOps Fundamentals con un tutor IA — gratis

Scrivi ed esegui vero codice nel tuo browser, ricevi aiuto istantaneo da un tutor IA disponibile 24/7, e riprendi da dove hai lasciato sul web o nell'app.

Corsi
12
Lezioni
48

Domande Frequenti

La lezione «Metriche, dashboard e SLI/SLO» è gratuita?

Sì — il testo completo di «Metriche, dashboard e SLI/SLO» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso Docker & DevOps Fundamentals, passa a CoddyKit PRO. Il corso Docker & DevOps Fundamentals include 4 lezioni in totale.

Cosa imparerò in «Metriche, dashboard e SLI/SLO»?

Trasformi i dati grezzi di monitoraggio in metriche e dashboard significative e definisca Service Level Indicator e Objective per misurare l'affidabilità che interessa davvero agli utenti. Eserciti Docker & DevOps Fundamentals con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.

Ho bisogno di esperienza per iniziare Docker & DevOps Fundamentals?

Non è richiesta alcuna esperienza precedente. Docker & DevOps Fundamentals su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 4 di 4.

Quanto tempo richiede la lezione «Metriche, dashboard e SLI/SLO»?

La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.

Posso scrivere ed eseguire codice in questa lezione Docker & DevOps Fundamentals?

Sì. Ogni lezione Docker & DevOps Fundamentals include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.

Tutte le lezioni di questo corso

  1. Introduzione al monitoraggio
  2. Soluzioni di logging centralizzato
  3. Alerting e risposta agli incidenti
  4. Metriche, dashboard e SLI/SLO
← Torna a Docker & DevOps Fundamentals