All Products
Search
Document Center

Platform For AI:Pencatatan log, pemantauan, dan peringatan

Last Updated:Aug 25, 2026

EAS menyediakan kemampuan observabilitas yang mencakup log waktu nyata, pengumpulan log SLS, pemantauan layanan, dasbor pemantauan, peringatan pemantauan, dan pemantauan Prometheus, meliputi seluruh alur mulai dari deteksi masalah dan troubleshooting hingga analisis jangka panjang.

Ikhtisar

Log, pemantauan, dan peringatan masing-masing memainkan peran berbeda dalam respons insiden:

  • Log: Menangkap output layanan secara detail—seperti pesan startup, penanganan permintaan, dan jejak stack error—sehingga Anda dapat mengidentifikasi akar penyebab suatu masalah.

  • Pemantauan: Menampilkan tren layanan melalui metrik dan grafik (QPS, latensi, laju error, penggunaan sumber daya) sehingga Anda dapat mendeteksi anomali dan merencanakan kapasitas.

  • Peringatan: Menerapkan ambang batas pada metrik pemantauan dan memberi notifikasi saat terjadi masalah, sehingga mendorong tindakan tepat waktu.

Alur troubleshooting khas: peringatan dipicu → pemantauan mempersempit metrik dan jendela waktu yang terdampak → log mengungkap akar penyebabnya.

Log

EAS menyediakan kemampuan pencatatan dan perekaman log berikut. Pilih berdasarkan kasus penggunaan Anda:

  • Kueri log historis: Lakukan kueri log masa lalu pada tab Log di halaman detail layanan, dengan filter per instans, pencarian kata kunci, dan filter rentang waktu. Fitur ini paling cocok untuk pengambilan dan analisis log.

  • Pelacakan log waktu nyata: Pilih sebuah instans dalam daftar Service Instance, lalu klik Real-time Logs untuk mengalirkan output rolling kontainer. Fitur ini paling cocok untuk debugging interaktif dan skenario yang memerlukan visibilitas waktu nyata, seperti memantau output inferensi token demi token.

    Catatan

    Log waktu nyata tidak tersedia untuk layanan yang dibuat sebelum fitur ini diluncurkan. Buat ulang layanan tersebut untuk menggunakannya.

  • Pengumpulan log SLS: Kumpulkan log layanan EAS ke SLS melalui tiga metode integrasi—tab Insights untuk onboarding cepat, Cloud Monitor 2.0 Access Center untuk integrasi batch, dan Logtail SLS untuk konfigurasi manual—mencakup skenario mulai dari penyiapan cepat layanan tunggal hingga pengumpulan kustom tingkat lanjut. Untuk detailnya, lihat Konfigurasikan pengumpulan log.

  • Persistensi catatan panggilan: Simpan semua catatan permintaan dan respons layanan ke MaxCompute atau SLS untuk audit, analisis panggilan, atau troubleshooting. Untuk mengaktifkannya, buka bagian Features selama penerapan layanan dan aktifkan Save Call Records, lalu pilih target penyimpanan:

    • MaxCompute: Pilih MaxCompute Project yang sudah ada (jika belum ada, lihat Buat proyek MaxCompute), lalu konfigurasikan nama MaxCompute Table. Sistem akan secara otomatis membuat tabel ini di proyek yang dipilih saat layanan diterapkan.

    • Simple Log Service: Pilih Simple Log Service Project yang sudah ada (jika belum ada, lihat Buat proyek), lalu konfigurasikan nama logstore. Sistem akan secara otomatis membuat Logstore ini di proyek yang dipilih saat layanan diterapkan.

Pemantauan

EAS menyediakan lima kemampuan pemantauan. Pilih berdasarkan cakupan pemantauan dan sumber metrik:

  • Pemantauan layanan (per layanan): Lihat metrik waktu proses dasar seperti QPS, latensi, laju error, dan penggunaan sumber daya untuk satu layanan, dengan kemampuan beralih antara dimensi Service dan Instance. Fitur ini berfungsi langsung tanpa konfigurasi tambahan—buka tab Monitoring di halaman detail layanan. Untuk detailnya, lihat Lihat metrik pemantauan layanan.

  • Dasbor pemantauan (agregasi tingkat wilayah): Menggabungkan metrik layanan dari semua ruang kerja di bawah akun saat ini di wilayah yang dipilih ke dalam satu dasbor terpadu untuk pemeriksaan kesehatan multi-layanan dan perencanaan kapasitas. Perpindahan antar ruang kerja tidak memengaruhi cakupan data. Untuk detailnya, lihat Dasbor pemantauan.

  • Metrik pemantauan kustom (per layanan, dilaporkan pengguna): Laporkan metrik bisnis seperti jumlah token inferensi, ukuran batch, dan tingkat hit untuk mendorong auto scaling. Fitur ini memerlukan instrumentasi dalam kode layanan Anda. Untuk detailnya, lihat Metrik pemantauan dan auto scaling kustom.

  • Pemantauan Prometheus (tingkat akun, integrasi sistem eksternal): Hubungkan metrik pemantauan EAS ke Prometheus melalui Cloud Monitor 2.0 Access Center, lakukan kueri metrik dengan PromQL, dan integrasikan dengan Grafana atau sistem pemantauan lainnya. Fitur ini mencakup metrik lanjutan seperti metrik framework inferensi dan metrik komputasi GPU, serta dikenakan biaya tambahan. Untuk detailnya, lihat Pantau layanan inferensi EAS dengan Prometheus.

  • Tracing (per layanan, ARMS): Tracing rantai panggilan berbasis ARMS untuk mengidentifikasi bottleneck performa lintas komponen. Beberapa image resmi mendukung aktivasi satu klik; untuk image lainnya, integrasikan probe ARMS ke dalam perintah waktu proses. Untuk detailnya, lihat Aktifkan tracing untuk aplikasi LLM di EAS.

Peringatan

EAS mendukung dua skenario peringatan. Pilih berdasarkan sumber pemicu notifikasi:

  • Peringatan metrik: Memberi notifikasi saat metrik pemantauan—seperti laju error, latensi, atau penggunaan sumber daya—melebihi ambang batas yang dikonfigurasi. Buat aturan berdasarkan metrik pemantauan layanan. Untuk detailnya, lihat Konfigurasikan peringatan pemantauan layanan.

  • Event CloudMonitor: Mendengarkan event siklus hidup layanan—seperti penyelesaian penerapan, penskalaan, dan keluar instans yang tidak terduga—lalu mengirim notifikasi. Untuk detailnya, lihat Lihat event EAS di CloudMonitor.

FAQ

T: Mengapa log tidak muncul di tab Log pada halaman detail layanan?

Penyebab umum:

  • Instans layanan belum selesai memulai—masih menarik image atau melakukan inisialisasi.

  • Proses layanan tidak menulis log ke stdout atau stderr.

  • Jendela waktu kueri terlalu sempit, atau instans yang dipilih tidak memiliki log. Perluas rentang waktu atau beralih ke All instances dan coba lagi.

T: Bagaimana hubungan antara tab Log di konsol dengan pengumpulan log SLS?

Keduanya digunakan untuk kueri log pasca kejadian, tetapi melayani kebutuhan berbeda. Tab Log di konsol berfungsi langsung tanpa konfigurasi dan cocok untuk troubleshooting cepat pada satu layanan dalam jendela waktu terkini. Pengumpulan log SLS mendukung retensi jangka panjang, analisis korelasi lintas layanan, dan pengarsipan untuk kepatuhan, serta onboarding melalui tab Insights juga berfungsi langsung tanpa konfigurasi. Anda dapat mengaktifkan keduanya dan memilih yang paling sesuai dengan skenario.