Observabilitas komprehensif menjaga widget Anda tetap dapat diandalkan. Pelacakan kesalahan menangkap pengecualian dengan konteks penuh. Pemantauan kinerja melacak TTFB, FCP, dan waktu render. Pemeriksaan kesehatan memungkinkan pemantauan waktu aktif. Aturan peringatan memberi tahu insinyur yang bertugas. Halaman status menjaga pelanggan tetap terinformasi.
Keandalan memerlukan visibilitas. Anda tidak dapat memperbaiki apa yang tidak dapat Anda lihat. Infrastruktur pemantauan dan peringatan kami menyediakan observabilitas komprehensif ke dalam kesehatan widget, kinerja, kesalahan, dan pengalaman pengguna — memungkinkan deteksi insiden proaktif dan respons cepat.
Setiap pengecualian ditangkap, diperkaya dengan konteks, dan diteruskan ke layanan pelacakan kesalahan (Sentry, Rollbar, Bugsnag, Application Insights). Data yang ditangkap mencakup:
Metrik kunci dilacak berdasarkan persentil (p50, p75, p90, p95, p99):
Metrik p95/p99 memastikan kasus tepi yang mempengaruhi persentase kecil pengguna ditangani.
Tentukan ambang kinerja yang dapat diterima:
Pemantauan memberi peringatan ketika kinerja dunia nyata melanggar anggaran.
Ambang untuk peristiwa yang dapat ditindaklanjuti:
Peringatan diarahkan melalui sistem yang bertugas (PagerDuty, Opsgenie) dengan kebijakan eskalasi dan buku panduan terlampir.
/health — mengembalikan 200 OK jika layanan beroperasi/health/deep — memverifikasi konektivitas database, akses basis pengetahuan, dan ketersediaan layanan AIPemeriksaan kesehatan dilakukan setiap 30-60 detik dari beberapa wilayah geografis. Kepatuhan SLA dilacak secara otomatis.
Model pembelajaran mesin mendeteksi pola yang tidak biasa: