0Pricing
MLOps Academy · Lezione

Segnalare picchi di latenza ed errori

Attivi gli alert prima che gli utenti ne subiscano le conseguenze.

Segnalare picchi di latenza ed errori è una lezione MLOps Academy gratuita su CoddyKit. Questa è la lezione 4 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento MLOps Academy, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso MLOps Academy include 4 lezioni in totale.

Le dashboard non inviano notifiche

Una dashboard è utile solo quando qualcuno la sta guardando. Gli avvisi monitorano le metriche senza interruzioni e La contattano non appena qualcosa si rompe. 🚨

Inviare avvisi prima che gli utenti se ne accorgano

L'obiettivo è attivare l'avviso prima che gli utenti se ne accorgano. Intercetti l'aumento graduale della latenza o degli errori quando c'è ancora tempo per reagire.

Una regola di avviso

Una regola di avviso è un'espressione PromQL più una condizione. Quando l'espressione rimane vera abbastanza a lungo, l'avviso si attiva.

Avvisare in caso di latenza elevata

Monitori la latenza p99 e attivi un avviso quando supera una soglia, ad esempio mezzo secondo, segnalando che il modello è troppo lento.

histogram_quantile(0.99, rate(predict_seconds_bucket[5m])) > 0.5

Avvisare in caso di picchi di errori

Attivi un avviso quando il rapporto degli errori supera una piccola percentuale, ad esempio quando il cinque percento delle richieste fallisce negli ultimi minuti.

rate(errors_total[5m]) / rate(predictions_total[5m]) > 0.05

Usare una durata di permanenza

La clausola for richiede che la condizione rimanga verificata per un periodo continuativo prima di attivare l'avviso, così un picco di un secondo non sveglierà nessuno.

- alert: HighLatency
  expr: histogram_quantile(0.99, rate(predict_seconds_bucket[5m])) > 0.5
  for: 5m

Etichettare la gravità

Associ a ogni regola delle etichette, come la gravità. Consentono di indirizzare un avviso critico in modo diverso rispetto a un avviso a bassa priorità.

labels:
  severity: critical

Aggiungere annotazioni utili

Usi le annotazioni per scrivere un riepilogo chiaro e un link al runbook, così chi riceve la notifica sa cosa si è guastato e cosa fare.

annotations:
  summary: "p99 latency above 500ms on model-api"

Alertmanager gestisce l'invio

Prometheus decide quando attivare un avviso, ma Alertmanager gestisce l'invio, il raggruppamento e la disattivazione temporanea di questi avvisi.

Inviare a una destinazione realmente monitorata

Indirizzi gli avvisi a un ricevitore che le persone controllano davvero, come Slack o PagerDuty, invece che a una casella di posta che nessuno legge.

receivers:
  - name: oncall
    slack_configs:
      - channel: "#ml-alerts"

Ridurre il rumore

Troppi falsi allarmi causano la fatica da avvisi e le persone smettono di leggerli. Regoli le soglie e la durata for finché ogni notifica non merita di farla svegliare.

Verifica rapida

Vuole un avviso che ignori i picchi momentanei e si attivi solo in presenza di problemi persistenti. Che cosa lo permette?

Riepilogo

Ha scritto regole di avviso PromQL per la latenza e i picchi di errori, ha usato una durata for per ignorare i picchi momentanei e ha indirizzato gli avvisi attivi tramite Alertmanager alle persone giuste. ✅

Domande Frequenti

La lezione «Segnalare picchi di latenza ed errori» è gratuita?

Sì — il testo completo di «Segnalare picchi di latenza ed errori» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso MLOps Academy, passa a CoddyKit PRO. Il corso MLOps Academy include 4 lezioni in totale.

Cosa imparerò in «Segnalare picchi di latenza ed errori»?

Attivi gli alert prima che gli utenti ne subiscano le conseguenze. Eserciti MLOps Academy con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.

Ho bisogno di esperienza per iniziare MLOps Academy?

Non è richiesta alcuna esperienza precedente. MLOps Academy su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 4 di 4.

Quanto tempo richiede la lezione «Segnalare picchi di latenza ed errori»?

La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.

Posso scrivere ed eseguire codice in questa lezione MLOps Academy?

Sì. Ogni lezione MLOps Academy include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.

Tutte le lezioni di questo corso

  1. Log strutturati per le previsioni
  2. Esporre le metriche con Prometheus
  3. Creare una dashboard Grafana
  4. Segnalare picchi di latenza ed errori
← Torna a MLOps Academy