Zurück zum Blog

#Incidents

Monitoring-Dashboard mit Uptime-Prozent, MTTR und MTBF nebeneinander
Monitoring

Uptime, MTTR, MTBF und die Neunen: Monitoring-Begriffe einfach erklärt

Die wichtigsten Monitoring-Begriffe klar erklärt, jeweils mit dem, was sie für deinen Kundenvertrag bedeuten.

Florian Zaskoku8 Min. Lesezeit
Monitor-Ansicht mit fehlgeschlagenem Content-Check nach einer manipulierten Kundenseite
Sicherheit und Compliance

Defacement erkennen: Website-Manipulation überwachen, bevor deine Kunden es tun

Warum eine gekaperte Kundenseite oft tagelang unbemerkt bleibt und wie du die Reaktionszeit auf Minuten senkst.

Florian Zaskoku9 Min. Lesezeit
Wartungsfenster-Konfiguration mit Zeitfenster und pausierter Alarmierung für mehrere Kundenmonitore
Incidents

Wartungsfenster richtig setzen: Geplante Downtime ohne Fehlalarm-Lawine

So pausierst du mit einem Wartungsfenster die Alarmierung bei geplanter Wartung und zeigst sie in der Status-Historie sauber als Wartung an.

Florian Zaskoku8 Min. Lesezeit
Ein Monitoring-Alarm, der gleichzeitig nach Slack, Microsoft Teams und an einen Webhook geroutet wird
Incidents

Monitoring-Alerts in Slack, Teams & per Webhook einrichten

Einrichtung pro Kanal, Slack, Microsoft Teams, Webhook, plus die Webhook-Payload-Struktur (JSON) für eigene Pipelines. Mit Beispielen.

Florian Zaskoku11 Min. Lesezeit
Eine Eskalationskette, in der ein unbeantworteter Alarm automatisch zur nächsten verantwortlichen Person weiterläuft
Incidents

Eskalationsrichtlinien & On-Call-Routing für kleine Teams einrichten

Eskalationsketten ohne PagerDuty-Komplexität: Wie kleine Agenturen ohne 24/7-NOC ein verlässliches On-Call-Routing aufsetzen, Schritt für Schritt.

Florian Zaskoku11 Min. Lesezeit
Übersicht der HTTP-5xx-Fehlercodes 500, 502, 503 und 504 mit Ursache und Bedeutung
Incidents

HTTP-Fehlercodes erklärt: 500, 502, 503, 504 und was sie für deine Kunden bedeuten

Fehler-Lexikon der wichtigsten HTTP-5xx-Codes: Ursache, Behebung und wie Monitoring den Fehler meldet, bevor dein Kunde anruft.

Florian Zaskoku11 Min. Lesezeit
Server läuft, aber die Seite lädt nicht: die DNS-Auflösung zwischen Nutzer und Server ist unterbrochen
Incidents

„Seite nicht erreichbar" trotz laufendem Server: wenn DNS das Problem ist

Warum eine Seite „down" wirkt, obwohl der Server läuft, DNS-Hijacking, abgelaufene Delegation, falsche Records, und wie man das früh erkennt.

Florian Zaskoku10 Min. Lesezeit
Nutzer prüft den Server-Status eines großen Online-Dienstes auf einer Status-Seite während einer Störung
Incidents

Fremde Dienste-Ausfälle (YouTube, WhatsApp & Co.) und was sie über deine Status-Kommunikation lehren

Warum Millionen bei einem Ausfall den Server-Status prüfen, und was professionelle Status-Kommunikation der Großen richtig macht, das jede Agentur im Kleinen adaptieren kann.

Florian Zaskoku10 min read
Zeitleiste von Status-Updates während eines Incidents, vom ersten Hinweis bis zur Entwarnung
Incidents

Incidents & Wartungsfenster kommunizieren: Status-Updates, die Vertrauen schaffen

Vorlagen für Incident- und Wartungs-Kommunikation, die den Kunden beruhigen statt alarmieren: vom ersten Update bis zur Entwarnung.

Florian Zaskoku11 min read