Kompleksowa obserwowalność utrzymuje Twój widget niezawodnym. Śledzenie błędów rejestruje wyjątki z pełnym kontekstem. Monitorowanie wydajności śledzi TTFB, FCP i czasy renderowania. Kontrole zdrowia umożliwiają monitorowanie czasu działania. Zasady alertowania powiadamiają inżynierów na dyżurze. Strona statusu informuje klientów.
Niezawodność wymaga widoczności. Nie możesz naprawić tego, czego nie widzisz. Nasza infrastruktura monitorowania i alertowania zapewnia kompleksową obserwowalność zdrowia widgetu, wydajności, błędów i doświadczenia użytkownika — umożliwiając proaktywne wykrywanie incydentów i szybką reakcję.
Każdy wyjątek jest rejestrowany, wzbogacany o kontekst i przesyłany do usług śledzenia błędów (Sentry, Rollbar, Bugsnag, Application Insights). Zarejestrowane dane obejmują:
Kluczowe metryki śledzone według percentyli (p50, p75, p90, p95, p99):
Metryki p95/p99 zapewniają, że przypadki brzegowe wpływające na małe procenty użytkowników są adresowane.
Zdefiniuj akceptowalne progi wydajności:
Monitorowanie alertów, gdy rzeczywista wydajność narusza budżety.
Progi dla zdarzeń wymagających działania:
Alerty przechodzą przez systemy na dyżurze (PagerDuty, Opsgenie) z politykami eskalacji i dołączonymi instrukcjami operacyjnymi.
/health — zwraca 200 OK, jeśli usługa działa/health/deep — weryfikuje łączność z bazą danych, dostęp do bazy wiedzy i dostępność usługi AIKontrole zdrowia są uruchamiane co 30–60 sekund z wielu regionów geograficznych. Zgodność z SLA jest śledzona automatycznie.
Modele uczenia maszynowego wykrywają nietypowe wzorce: