Observabilitas EAS mencakup seluruh alur mulai dari deteksi masalah hingga analisis jangka panjang, melalui log Real-time, pengiriman log ke SLS, Pemantauan layanan, Dasbor, peringatan, serta integrasi ARMS.
Ikhtisar
Log, pemantauan, dan peringatan masing-masing memainkan peran berbeda dalam penanganan insiden:
Log: Menangkap output layanan secara detail—seperti pesan startup, penanganan permintaan, dan stack trace error—sehingga Anda dapat mengidentifikasi akar penyebab suatu masalah.
Pemantauan: Menampilkan tren layanan melalui metrik dan Grafik (QPS, latensi, laju error, Penggunaan sumber daya) sehingga Anda dapat mendeteksi anomali dan merencanakan kapasitas.
Peringatan: Menerapkan ambang batas pada metrik pemantauan dan memberi notifikasi saat terjadi masalah, sehingga mendorong aksi tepat waktu.
Alur troubleshooting khas: peringatan aktif → pemantauan mempersempit metrik dan rentang waktu yang terdampak → log mengungkap akar penyebabnya.
Log
EAS menyediakan tiga opsi logging. Pilih yang sesuai dengan kasus penggunaan Anda:
Log historis: Lihat log sebelumnya di tab Log pada halaman detail layanan, dengan filter per instans, pencarian Kata kunci, dan filter rentang waktu. Paling cocok untuk Pengambilan log dan analisis.
-
Log Real-time: Pilih sebuah instans dari daftar Service Instance, lalu klik Real-time Logs untuk mengalirkan output rolling dari Kontainer tersebut. Gunakan ini untuk debugging interaktif atau skenario yang memerlukan visibilitas langsung, seperti memantau output inferensi token per token.
CatatanLog Real-time tidak tersedia untuk layanan yang dibuat sebelum fitur ini diluncurkan. Buat ulang layanan tersebut untuk menggunakannya.
Pengiriman log ke SLS: Kirimkan log ke SLS untuk retensi jangka panjang, korelasi lintas layanan, dan arsip kepatuhan. Konfigurasikan aturan pengiriman terlebih dahulu di kelompok sumber daya. Untuk detailnya, lihat Konfigurasi SLS untuk kelompok sumber daya.
Pemantauan
EAS menyediakan empat opsi pemantauan. Pilih berdasarkan sumber metrik dan cara penyajian datanya:
Pemantauan layanan: Lihat metrik waktu proses dasar seperti QPS, latensi, laju error, dan Penggunaan sumber daya. Berfungsi langsung tanpa konfigurasi tambahan—buka tab Monitoring pada halaman detail layanan. Untuk detailnya, lihat Lihat metrik Pemantauan layanan.
Metrik kustom: Laporkan metrik bisnis seperti jumlah token inferensi, ukuran Batch, dan tingkat hit dengan menambahkan instrumentasi ke kode layanan Anda. Untuk detailnya, lihat Metrik pemantauan kustom dan auto scaling.
Dasbor: Kumpulkan metrik utama dari beberapa layanan ke dalam satu papan terpadu. Paling cocok untuk Pemeriksaan kesehatan rutin lintas layanan. Untuk detailnya, lihat Dasbor Pemantauan.
Integrasi ARMS: Hubungkan ke Application Performance Monitoring (APM) untuk pelacakan terdistribusi dan identifikasi bottleneck performa lintas Komponen. Untuk detailnya, lihat Sesuaikan Dasbor observabilitas dan peringatan menggunakan ARMS.
Peringatan
EAS mendukung dua skenario peringatan. Pilih berdasarkan apa yang memicu notifikasi:
Peringatan metrik: Memberi notifikasi saat metrik pemantauan—seperti laju error, latensi, atau Penggunaan sumber daya—melebihi ambang batas yang dikonfigurasi. Buat aturan berdasarkan metrik Pemantauan layanan. Untuk detailnya, lihat Konfigurasi peringatan Pemantauan layanan.
Event CloudMonitor: Mendengarkan event siklus hidup layanan—seperti penyelesaian penerapan, penskalaan, dan keluar instans yang tidak terduga—lalu mengirimkan notifikasi. Untuk detailnya, lihat Lihat event EAS di CloudMonitor.
FAQ
T: Mengapa log tidak muncul di tab Log pada halaman detail layanan?
Penyebab umum:
Instans layanan belum selesai startup—masih dalam proses menarik image atau inisialisasi.
Proses layanan tidak menulis log ke stdout atau stderr.
Rentang waktu kueri terlalu sempit, atau instans yang dipilih tidak memiliki log. Perluas rentang waktu atau beralih ke All instances lalu coba lagi.
T: Bagaimana hubungan antara tab Log di Konsol dengan pengiriman log ke SLS?
Keduanya memungkinkan Anda mencari log setelah kejadian, tetapi melayani kebutuhan berbeda. Tab Log di Konsol berfungsi langsung tanpa konfigurasi dan cocok untuk troubleshooting cepat pada satu layanan dalam rentang waktu terkini. Pengiriman log ke SLS memerlukan konfigurasi, tetapi mendukung retensi jangka panjang, korelasi lintas layanan, dan arsip kepatuhan. Anda dapat mengaktifkan keduanya dan memilih yang sesuai dengan skenario.