Un'osservabilità completa mantiene il tuo widget affidabile. Il tracciamento degli errori cattura eccezioni con contesto completo. Il monitoraggio delle prestazioni tiene traccia di TTFB, FCP e tempi di rendering. I controlli di salute abilitano il monitoraggio dell'uptime. Le regole di allerta notificano gli ingegneri di guardia. La pagina di stato tiene informati i clienti.
L'affidabilità richiede visibilità. Non puoi riparare ciò che non puoi vedere. La nostra infrastruttura di monitoraggio e allerta fornisce un'osservabilità completa sulla salute del widget, prestazioni, errori ed esperienza utente — abilitando la rilevazione proattiva degli incidenti e una risposta rapida.
Ogni eccezione viene catturata, arricchita con contesto e inoltrata ai servizi di tracciamento degli errori (Sentry, Rollbar, Bugsnag, Application Insights). I dati catturati includono:
Metriche chiave tracciate per percentile (p50, p75, p90, p95, p99):
Le metriche p95/p99 garantiscono che i casi limite che influenzano piccole percentuali di utenti siano affrontati.
Definisci soglie di prestazione accettabili:
Il monitoraggio avvisa quando le prestazioni reali violano i budget.
Soglie per eventi azionabili:
Le allerte vengono instradate attraverso sistemi di guardia (PagerDuty, Opsgenie) con politiche di escalation e runbook allegati.
/health — restituisce 200 OK se il servizio è operativo/health/deep — verifica la connettività del database, l'accesso alla knowledge base e la disponibilità del servizio AII controlli di salute vengono eseguiti ogni 30-60 secondi da più regioni geografiche. La conformità SLA viene tracciata automaticamente.
I modelli di machine learning rilevano schemi insoliti: