#Incidents

Uptime, MTTR, MTBF und die Neunen: Monitoring-Begriffe einfach erklärt
Die wichtigsten Monitoring-Begriffe klar erklärt, jeweils mit dem, was sie für deinen Kundenvertrag bedeuten.

Defacement erkennen: Website-Manipulation überwachen, bevor deine Kunden es tun
Warum eine gekaperte Kundenseite oft tagelang unbemerkt bleibt und wie du die Reaktionszeit auf Minuten senkst.

Wartungsfenster richtig setzen: Geplante Downtime ohne Fehlalarm-Lawine
So pausierst du mit einem Wartungsfenster die Alarmierung bei geplanter Wartung und zeigst sie in der Status-Historie sauber als Wartung an.

Monitoring-Alerts in Slack, Teams & per Webhook einrichten
Einrichtung pro Kanal, Slack, Microsoft Teams, Webhook, plus die Webhook-Payload-Struktur (JSON) für eigene Pipelines. Mit Beispielen.

Eskalationsrichtlinien & On-Call-Routing für kleine Teams einrichten
Eskalationsketten ohne PagerDuty-Komplexität: Wie kleine Agenturen ohne 24/7-NOC ein verlässliches On-Call-Routing aufsetzen, Schritt für Schritt.

HTTP-Fehlercodes erklärt: 500, 502, 503, 504 und was sie für deine Kunden bedeuten
Fehler-Lexikon der wichtigsten HTTP-5xx-Codes: Ursache, Behebung und wie Monitoring den Fehler meldet, bevor dein Kunde anruft.

„Seite nicht erreichbar" trotz laufendem Server: wenn DNS das Problem ist
Warum eine Seite „down" wirkt, obwohl der Server läuft, DNS-Hijacking, abgelaufene Delegation, falsche Records, und wie man das früh erkennt.

Fremde Dienste-Ausfälle (YouTube, WhatsApp & Co.) und was sie über deine Status-Kommunikation lehren
Warum Millionen bei einem Ausfall den Server-Status prüfen, und was professionelle Status-Kommunikation der Großen richtig macht, das jede Agentur im Kleinen adaptieren kann.

Incidents & Wartungsfenster kommunizieren: Status-Updates, die Vertrauen schaffen
Vorlagen für Incident- und Wartungs-Kommunikation, die den Kunden beruhigen statt alarmieren: vom ersten Update bis zur Entwarnung.