La observabilidad integral mantiene su widget confiable. El seguimiento de errores captura excepciones con contexto completo. El monitoreo de rendimiento rastrea TTFB, FCP y tiempos de renderizado. Las verificaciones de salud permiten el monitoreo de tiempo de actividad. Las reglas de alerta notifican a los ingenieros de guardia. La página de estado mantiene informados a los clientes.
La fiabilidad requiere visibilidad. No puedes arreglar lo que no puedes ver. Nuestra infraestructura de monitoreo y alerta proporciona una observabilidad integral sobre la salud del widget, rendimiento, errores y experiencia del usuario, permitiendo la detección proactiva de incidentes y una respuesta rápida.
Cada excepción se captura, enriquece con contexto y se envía a servicios de seguimiento de errores (Sentry, Rollbar, Bugsnag, Application Insights). Los datos capturados incluyen:
Métricas clave rastreadas por percentil (p50, p75, p90, p95, p99):
Las métricas p95/p99 aseguran que se aborden los casos extremos que afectan a pequeños porcentajes de usuarios.
Defina umbrales de rendimiento aceptables:
Se monitorean alertas cuando el rendimiento del mundo real viola los presupuestos.
Umbrales para eventos accionables:
Las alertas se dirigen a través de sistemas de guardia (PagerDuty, Opsgenie) con políticas de escalamiento y libros de ejecución adjuntos.
/health — devuelve 200 OK si el servicio está operativo/health/deep — verifica conectividad de base de datos, acceso a base de conocimientos y disponibilidad del servicio de IALas verificaciones de salud se ejecutan cada 30-60 segundos desde múltiples regiones geográficas. El cumplimiento de SLA se rastrea automáticamente.
Modelos de aprendizaje automático detectan patrones inusuales: