Eine Status-Seite ist eine dedizierte Website – typischerweise auf separater Infrastruktur vom Hauptdienst gehostet – die meldet, ob jede Komponente eines Systems funktionsfähig, beeinträchtigt, teilweise ausfallend oder nicht verfügbar ist. Sie ist das wichtigste Werkzeug zur Kommunikation der Systemgesundheit an Kunden und Endnutzer während Zwischenfällen und Wartungsfenstern.
Status-Seiten ziehen Live-Daten aus internen Uptime-Überwachungs-systemen, synthetischen Checks und Incident-Management-Tools. Updates werden entweder manuell von einem Incident Commander oder automatisch per Webhooks ausgelöst, wenn ein Zwischenfall beginnt oder behoben wird. Die meisten Seiten nutzen eine Standard-Vierstufigkeit: Operational, Degraded Performance, Partial Outage und Major Outage.
Bei einem Zwischenfall protokolliert die Seite die Zeitleiste – von Investigating über Identified and Monitoring bis Resolved – und benachrichtigt Abonnenten per E-Mail, SMS, RSS-Feeds oder Slack-Integrationen. Diese Transparenz reduziert den Support-Aufwand, indem Nutzer sich selbst informieren können, statt den Support zu kontaktieren.
Status-Seiten führen auch historische Uptime-Logs, gewöhnlich ein rollierendes 90-Tage-Protokoll, das Teams zur Berechnung der SLA-Verfügbarkeitsprozentsätze nutzen. Beispielsweise entspricht 99,9% Uptime ("three nines") 8,76 Stunden zulässiger Ausfallzeit pro Jahr.
TipEine Status-Seite ist am wirksamsten, wenn sie auf zuverlässiger, geografisch verteilter Infrastruktur separat von Ihrem Hauptdienst gehostet wird, damit sie auch bei einem Ausfall erreichbar bleibt.
Sie können eine Status-Seite mit Incident-Response-Workflows, On-Call-Planung und Kundenbenachrichtigungssystemen integrieren, um die Kommunikation automatisch und konsistent zu gestalten.