Zurück zum Blog

Beiträge in Incidents

Wenn etwas ausfällt, laufen zwei Uhren: die bis du es merkst, und die bis dein Kunde es merkt. Diese Beiträge halten die erste kurz, Fehlerbilder deuten, Alarme an jemanden routen, der auch wach ist, und auf der Statusseite etwas Brauchbares sagen, bevor sich dein Support-Postfach füllt.

Wartungsfenster-Konfiguration mit Zeitfenster und pausierter Alarmierung für mehrere Kundenmonitore
Incidents

Wartungsfenster richtig setzen: Geplante Downtime ohne Fehlalarm-Lawine

So pausierst du mit einem Wartungsfenster die Alarmierung bei geplanter Wartung und zeigst sie in der Status-Historie sauber als Wartung an.

Florian Zaskoku8 Min. Lesezeit
Ein Monitoring-Alarm, der gleichzeitig nach Slack, Microsoft Teams und an einen Webhook geroutet wird
Incidents

Monitoring-Alerts in Slack, Teams & per Webhook einrichten

Einrichtung pro Kanal, Slack, Microsoft Teams, Webhook, plus die Webhook-Payload-Struktur (JSON) für eigene Pipelines. Mit Beispielen.

Florian Zaskoku11 Min. Lesezeit
Eine Eskalationskette, in der ein unbeantworteter Alarm automatisch zur nächsten verantwortlichen Person weiterläuft
Incidents

Eskalationsrichtlinien & On-Call-Routing für kleine Teams einrichten

Eskalationsketten ohne PagerDuty-Komplexität: Wie kleine Agenturen ohne 24/7-NOC ein verlässliches On-Call-Routing aufsetzen, Schritt für Schritt.

Florian Zaskoku11 Min. Lesezeit
Eine korrekt verschickte E-Mail, die im Spam-Ordner statt im Posteingang landet
Incidents

Kunden-Mails landen im Spam? Woran es liegt und wie du es früh erkennst

Warum Kunden-Mails im Spam landen, Blacklisting, fehlendes DKIM/SPF, schlechte IP-Reputation, und wie laufende Überwachung das früh meldet.

Florian Zaskoku11 Min. Lesezeit
Browser-Sicherheitswarnung wegen eines abgelaufenen SSL-Zertifikats, die Besucher abschreckt
Incidents

Abgelaufenes SSL-Zertifikat: der Reputations-GAU, den kein Kunde verzeiht

Was passiert, wenn ein SSL-Zertifikat abläuft, Browser-Warnung, Vertrauensverlust, und wie automatische Ablauf-Alerts den Reputations-GAU verhindern.

Florian Zaskoku10 Min. Lesezeit
Übersicht der HTTP-5xx-Fehlercodes 500, 502, 503 und 504 mit Ursache und Bedeutung
Incidents

HTTP-Fehlercodes erklärt: 500, 502, 503, 504 und was sie für deine Kunden bedeuten

Fehler-Lexikon der wichtigsten HTTP-5xx-Codes: Ursache, Behebung und wie Monitoring den Fehler meldet, bevor dein Kunde anruft.

Florian Zaskoku11 Min. Lesezeit
Server läuft, aber die Seite lädt nicht: die DNS-Auflösung zwischen Nutzer und Server ist unterbrochen
Incidents

„Seite nicht erreichbar" trotz laufendem Server: wenn DNS das Problem ist

Warum eine Seite „down" wirkt, obwohl der Server läuft, DNS-Hijacking, abgelaufene Delegation, falsche Records, und wie man das früh erkennt.

Florian Zaskoku10 Min. Lesezeit
Nutzer prüft den Server-Status eines großen Online-Dienstes auf einer Status-Seite während einer Störung
Incidents

Fremde Dienste-Ausfälle (YouTube, WhatsApp & Co.) und was sie über deine Status-Kommunikation lehren

Warum Millionen bei einem Ausfall den Server-Status prüfen, und was professionelle Status-Kommunikation der Großen richtig macht, das jede Agentur im Kleinen adaptieren kann.

Florian Zaskoku10 min read
Zeitleiste von Status-Updates während eines Incidents, vom ersten Hinweis bis zur Entwarnung
Incidents

Incidents & Wartungsfenster kommunizieren: Status-Updates, die Vertrauen schaffen

Vorlagen für Incident- und Wartungs-Kommunikation, die den Kunden beruhigen statt alarmieren: vom ersten Update bis zur Entwarnung.

Florian Zaskoku11 min read