Draaiboek voor debuggen in productie en incidentrespons · Les

Automatisch incidenten aanmaken vanuit alerts

Integreer monitoringsystemen met platforms voor incidentbeheer om incidenten automatisch aan te maken en te escaleren

Les 3 van 411 stappen

Automatisch incidenten aanmaken vanuit alerts is een gratis Draaiboek voor debuggen in productie en incidentrespons-les op CoddyKit. Dit is les 3 van 4. Je kunt 3 lessen uit dit leerpad gratis volledig lezen — daarna ontgrendelt CoddyKit PRO alle lessen, plus praktische oefeningen met een ingebouwde code-editor en een AI-tutor die 24/7 beschikbaar is. Deze les maakt deel uit van het leertraject Draaiboek voor debuggen in productie en incidentrespons. Je voortgang wordt gesynchroniseerd op het web en in de CoddyKit-app. De cursus Draaiboek voor debuggen in productie en incidentrespons bevat in totaal 4 lessen.

Waarom incidenten automatisch aanmaken?

Stel dat uw systemen 24 uur per dag, 7 dagen per week worden gemonitord. Wanneer er iets misgaat, wordt er een waarschuwing geactiveerd. Wat gebeurt er daarna?

Handmatig een incidentticket aanmaken op basis van een waarschuwing is traag en foutgevoelig. Automatisering zorgt ervoor dat kritieke problemen direct en consistent worden aangepakt.

De handmatige incidentlus

Zonder automatisering kan het proces er als volgt uitzien:

  • Het monitoringsysteem detecteert een hoge CPU-belasting.
  • Een engineer ziet de waarschuwing.
  • De engineer meldt zich aan bij een incidentplatform.
  • De engineer maakt handmatig een nieuw incidentticket aan.
  • De engineer vult gegevens in, zoals ernst, service en beschrijving.
  • De engineer wijst het ticket toe aan het juiste team.

Dit leidt tot vertragingen en een grotere kans op menselijke fouten.

Waarschuwingen met incidenten verbinden

Het automatisch aanmaken van incidenten sluit de lus. Het verbindt uw monitoringsysteem rechtstreeks met uw platform voor incidentbeheer.

Dit is de basisstroom:

  • Het monitoringsysteem detecteert een probleem.
  • Er wordt een waarschuwing gegenereerd.
  • De gegevens van de waarschuwing worden automatisch naar het platform voor incidentbeheer (IMP) gestuurd.
  • Het IMP maakt op basis van de ontvangen gegevens een nieuw incident aan.

Belangrijkste hulpmiddelen in de werkstroom

Drie hoofdtypen hulpmiddelen werken samen voor deze automatisering:

  • Monitoringsysteem: Detecteert problemen (bijvoorbeeld Prometheus, Datadog).
  • Waarschuwingsengine: Verwerkt monitoringgegevens om waarschuwingen te genereren (vaak onderdeel van het monitoringsysteem of een apart onderdeel zoals Alertmanager).
  • Platform voor incidentbeheer (IMP): Ontvangt waarschuwingen, maakt incidenten aan, beheert bereikbaarheidsdiensten en handelt escalaties af (bijvoorbeeld PagerDuty, Opsgenie).

Webhooks: de boodschapper voor waarschuwingen

Hoe communiceren deze systemen met elkaar?

Een van de meest gangbare en flexibele manieren is het gebruik van webhooks. Een webhook is eenvoudigweg een HTTP POST-verzoek dat naar een specifieke URL wordt gestuurd wanneer er een gebeurtenis plaatsvindt.

Zie het als een automatische deurbel voor uw platform voor incidentbeheer. Wanneer er een waarschuwing afgaat, ‘belt’ het monitoringsysteem aan bij het IMP.

Voorbeeld van webhookgegevens

Wanneer een waarschuwing afgaat, stuurt het monitoringsysteem een informatiepakket (vaak in JSON-indeling) naar de webhook-URL van het IMP. Deze gegevens bevatten alles wat het IMP nodig heeft om een incident aan te maken.

Zo kunnen die gegevens er vereenvoudigd uitzien:

{
  "alertName": "High CPU Usage",
  "severity": "critical",
  "service": "web-app-api",
  "timestamp": "2023-10-27T10:30:00Z",
  "details": "CPU > 90% for 5 mins",
  "monitoringUrl": "http://monitor.example.com/cpu-dashboard"
}

Waarschuwingen ontvangen in IMP's

Platforms voor incidentbeheer (IMP's) zijn geconfigureerd om naar deze webhooks te luisteren. Elk IMP biedt een unieke URL voor binnenkomende waarschuwingen.

Wanneer een IMP de webhookgegevens ontvangt, doet het het volgende:

  • Het parseert de JSON-payload.
  • Het koppelt velden (zoals ernst, service en beschrijving) aan de eigen incidentvelden.
  • Het maakt automatisch een nieuw incident aan.
  • Het bepaalt welke service of welk team is getroffen.

Slimme escalatiebeleidsregels

Automatisch incidenten aanmaken gaat niet alleen over het aanmaken van een ticket. Het gaat er ook om dat dit ticket snel bij de juiste persoon terechtkomt!

IMP's gebruiken escalatiebeleidsregels om te bepalen wie wanneer wordt geïnformeerd. Deze beleidsregels kunnen:

  • Bereikbaarheidsroosters opzoeken.
  • Op basis van de details van een waarschuwing verschillende personen of teams informeren (waarschuwingen over een ‘database’ gaan bijvoorbeeld naar het databaseteam).
  • Via verschillende niveaus escaleren (bijvoorbeeld eerst de primaire dienstdoende persoon bellen en na 5 minuten de secundaire).

Voordelen: snelheid en nauwkeurigheid

Het automatiseren van deze kritieke stap biedt aanzienlijke voordelen:

  • Snellere reactie: Incidenten worden direct aangemaakt, waardoor de gemiddelde detectietijd (MTTD) en gemiddelde oplostijd (MTTR) afnemen.
  • Minder fouten: Handmatige typefouten en ontbrekende gegevens worden voorkomen.
  • Consistente werkstroom: Elke waarschuwing volgt hetzelfde, vooraf gedefinieerde proces.
  • Engineers vrijmaken: Minder handmatig werk betekent dat engineers zich kunnen richten op het oplossen van problemen in plaats van op het aanmaken van tickets.

Controle van automatisch incidentbeheer

Test uw begrip van de belangrijkste onderdelen en hun rol bij het automatisch aanmaken van incidenten.

Samenvatting: de incidentstroom automatiseren

In deze les hebt u geleerd hoe u monitoringsystemen integreert met platforms voor incidentbeheer om incidenten automatisch aan te maken en te escaleren.

  • Automatisering stroomlijnt het proces van waarschuwing naar incident, bespaart tijd en vermindert fouten.
  • Belangrijke onderdelen zijn monitoringsystemen, waarschuwingsengines en platforms voor incidentbeheer.
  • Webhooks zijn een gangbare manier waarop deze systemen communiceren en waarschuwingsgegevens naar het IMP sturen.
  • Deze automatisering leidt tot een snellere, nauwkeurigere en consistentere incidentrespons.

Door te automatiseren zorgt u ervoor dat kritieke problemen nooit worden gemist en altijd snel bij het juiste team terechtkomen.

Gratis beginnen

Leer Draaiboek voor debuggen in productie en incidentrespons met een AI-tutor — gratis

Schrijf echte code en voer die uit in je browser, krijg direct hulp van een AI-tutor die 24/7 beschikbaar is en ga verder waar je gebleven bent op het web of in de app.

Cursussen
12
Lessen
48

Veelgestelde vragen

Is de les “Automatisch incidenten aanmaken vanuit alerts” gratis?

Ja — je kunt hier op het web alle 3 lessen van het leerpad Draaiboek voor debuggen in productie en incidentrespons, waaronder “Automatisch incidenten aanmaken vanuit alerts”, gratis volledig lezen. Daarna ontgrendelt CoddyKit PRO alle lessen, plus interactieve oefeningen met een ingebouwde code-editor en een AI-tutor die 24/7 beschikbaar is. De cursus Draaiboek voor debuggen in productie en incidentrespons bevat in totaal 4 lessen.

Wat leer ik in “Automatisch incidenten aanmaken vanuit alerts”?

Integreer monitoringsystemen met platforms voor incidentbeheer om incidenten automatisch aan te maken en te escaleren Je oefent met Draaiboek voor debuggen in productie en incidentrespons door code rechtstreeks in de browser uit te voeren. Een AI-begeleider die 24/7 beschikbaar is beantwoordt je vragen terwijl je de les doorwerkt.

Heb ik ervaring nodig om met Draaiboek voor debuggen in productie en incidentrespons te beginnen?

Ervaring vooraf is niet nodig. Draaiboek voor debuggen in productie en incidentrespons op CoddyKit is opgebouwd voor beginners tot gevorderden, zodat je hier of bij het begin kunt starten en in je eigen tempo kunt leren. Dit is les 3 van 4.

Hoe lang duurt de les “Automatisch incidenten aanmaken vanuit alerts”?

De meeste lessen van CoddyKit duren ongeveer 5–10 minuten. Elke les is kort en interactief, zodat je gestaag vooruitgaat en op het web en in de app precies verdergaat waar je was gebleven.

Kan ik code schrijven en uitvoeren in deze les over Draaiboek voor debuggen in productie en incidentrespons?

Ja. Elke les over Draaiboek voor debuggen in productie en incidentrespons bevat een ingebouwde code-editor, zodat je rechtstreeks in je browser echte code kunt schrijven en uitvoeren en direct feedback van AI krijgt — lokale installatie is niet nodig.

Alle lessen in deze cursus

  1. Synthetic monitoring implementeren
  2. Geavanceerde technieken voor anomaliedetectie
  3. Automatisch incidenten aanmaken vanuit alerts
  4. Alertmoeheid verminderen met slimme alerting
← Terug naar Draaiboek voor debuggen in productie en incidentrespons