Umfassende Beobachtbarkeit hält Ihr Widget zuverlässig. Fehlerverfolgung erfasst Ausnahmen mit vollem Kontext. Leistungsüberwachung verfolgt TTFB, FCP und Renderzeiten. Gesundheitsprüfungen ermöglichen die Überwachung der Betriebszeit. Alarmierungsregeln benachrichtigen die Bereitschaftsteams. Statusseite hält Kunden informiert.
Zuverlässigkeit erfordert Sichtbarkeit. Sie können nicht reparieren, was Sie nicht sehen können. Unsere Überwachungs- und Alarmierungsinfrastruktur bietet umfassende Beobachtbarkeit der Widget-Gesundheit, Leistung, Fehler und Benutzererfahrung — ermöglicht proaktive Vorfallserkennung und schnelle Reaktion.
Jede Ausnahme wird erfasst, mit Kontext angereichert und an Fehlerverfolgungsdienste (Sentry, Rollbar, Bugsnag, Application Insights) weitergeleitet. Erfasste Daten umfassen:
Wichtige Metriken werden nach Perzentilen verfolgt (p50, p75, p90, p95, p99):
p95/p99-Metriken stellen sicher, dass Randfälle, die kleine Prozentsätze von Benutzern betreffen, angesprochen werden.
Definieren Sie akzeptable Leistungsgrenzen:
Überwachungswarnungen, wenn die reale Leistung die Budgets verletzt.
Schwellenwerte für umsetzbare Ereignisse:
Alarme werden über Bereitschaftssysteme (PagerDuty, Opsgenie) mit Eskalationsrichtlinien und angehängten Handbuchen weitergeleitet.
/health — gibt 200 OK zurück, wenn der Dienst betriebsbereit ist/health/deep — überprüft die Datenbankverbindung, den Zugriff auf die Wissensdatenbank und die Verfügbarkeit des KI-DienstesGesundheitsprüfungen werden alle 30–60 Sekunden aus mehreren geografischen Regionen durchgeführt. Die SLA-Konformität wird automatisch verfolgt.
Maschinenlernmodelle erkennen ungewöhnliche Muster: