포괄적인 가시성은 귀하의 위젯을 신뢰할 수 있게 유지합니다. 오류 추적은 전체 컨텍스트와 함께 예외를 캡처합니다. 성능 모니터링은 TTFB, FCP 및 렌더링 시간을 추적합니다. 상태 확인은 가동 시간 모니터링을 가능하게 합니다. 경고 규칙은 대기 중인 엔지니어에게 알립니다. 상태 페이지는 고객에게 정보를 제공합니다.
신뢰성을 위해서는 가시성이 필요합니다. 볼 수 없는 것은 수정할 수 없습니다. 우리의 모니터링 및 경고 인프라는 위젯의 건강, 성능, 오류 및 사용자 경험에 대한 포괄적인 가시성을 제공하여 사전 사고 감지 및 신속한 대응을 가능하게 합니다.
모든 예외는 캡처되어 컨텍스트와 함께 풍부해지며 오류 추적 서비스(Sentry, Rollbar, Bugsnag, Application Insights)로 전달됩니다. 캡처된 데이터에는 다음이 포함됩니다:
주요 메트릭은 백분위수(p50, p75, p90, p95, p99)로 추적됩니다:
p95/p99 메트릭은 소수의 사용자에게 영향을 미치는 엣지 케이스를 해결합니다.
허용 가능한 성능 임계값을 정의합니다:
실제 성능이 예산을 위반할 때 모니터링 경고가 발생합니다.
조치 가능한 이벤트에 대한 임계값:
경고는 대기 중인 시스템(PagerDuty, Opsgenie)을 통해 경로를 지정하며 에스컬레이션 정책 및 첨부된 실행 문서가 포함됩니다.
/health — 서비스가 작동 중이면 200 OK를 반환합니다./health/deep — 데이터베이스 연결, 지식 기반 접근 및 AI 서비스 가용성을 확인합니다.상태 확인은 여러 지리적 지역에서 매 30-60초마다 실행됩니다. SLA 준수는 자동으로 추적됩니다.
기계 학습 모델이 비정상적인 패턴을 감지합니다: