Mendiagnosis exception bisnis dalam arsitektur layanan mikro sering kali sulit dan memakan waktu. Application Real-Time Monitoring Service (ARMS) menyederhanakan proses ini dengan mengkorelasikan trace dan log, sehingga Anda dapat dengan cepat mengidentifikasi akar penyebab masalah serta meningkatkan efisiensi diagnosis.
Prasyarat
Anda telah mengaktifkan Simple Log Service (SLS). Jika belum, login ke Konsol SLS dan ikuti petunjuk di layar untuk mengaktifkan layanan tersebut.
Anda telah membuat Proyek. Untuk informasi lebih lanjut, lihat Mengelola proyek.
Anda telah membuat Logstore. Untuk informasi lebih lanjut, lihat Membuat Logstore dasar.
Informasi latar belakang
Sebelum melakukan troubleshooting dengan trace dan log, akan sangat membantu jika Anda memahami tiga konsep utama: metrik, tracing, dan logging.
Metrik: Metrik kinerja utama aplikasi Anda, seperti Application Service Request, Application Service Average Response Time, dan Application Dependent Service Request.
Tracing: Mewakili jalur permintaan lengkap dari ujung ke ujung. Satu trace menghubungkan semua panggilan antarmuka dan aksi terkait dalam aplikasi Anda.
Logging: Mengacu pada log bisnis terperinci yang dihasilkan aplikasi Anda untuk setiap panggilan antarmuka dan aksi request-response.
Ketika sebuah aplikasi mengalami exception bisnis, grafik metriknya sering menunjukkan fluktuasi signifikan. Anda dapat menggunakan grafik tersebut untuk analisis awal. Dengan memeriksa trace lengkap dan log bisnis, Anda dapat secara tepat menemukan akar penyebab exception tersebut.
Asosiasikan log bisnis dengan Trace ID
-
Login ke Konsol ARMS. Di panel navigasi sebelah kiri, pilih .
Pilih Wilayah di bilah navigasi atas dan klik aplikasi tersebut.
CatatanIkon di kolom Language menunjukkan bahasa pemrograman aplikasi:
: Java
: Go
: Python- (Hyphen): aplikasi yang dipantau di Managed Service for OpenTelemetry
Di bilah navigasi kiri, klik Application Settings, lalu di sisi kanan, klik tab Custom Configurations.
Di tab Custom Configurations, pada area Application Log Association, pilih Log Service sebagai sumber log, aktifkan sakelar Associate Business Logs with Trace ID, pilih Wilayah, lalu bind Proyek dan Logstore.
Dari daftar drop-down
Associated Index, pilihfull-text index.Di pojok kiri bawah tab Custom Configurations, klik Save.
Troubleshoot exception dengan metrik aplikasi
-
Login ke Konsol ARMS. Di panel navigasi sebelah kiri, pilih .
Pilih Wilayah di bilah navigasi atas dan klik aplikasi tersebut.
CatatanIkon di kolom Language menunjukkan bahasa pemrograman aplikasi:
: Java
: Go
: Python- (Hyphen): aplikasi yang dipantau di Managed Service for OpenTelemetry
Di bilah navigasi kiri, klik Application Overview, pilih Overall Analysis di bagian atas halaman, lalu pilih atau sesuaikan Rentang Waktu target di pojok kanan atas.
Halaman Overall Analysis menampilkan metrik utama aplikasi target, seperti Application Service Request, Application Service Average Response Time, dan Application Dependent Service Request.
Di halaman Overall Analysis, pilih metrik aplikasi dan seret kursor mouse Anda di atas grafik garisnya untuk memilih Rentang Waktu target.
Contoh ini menggunakan metrik Application Service Average Response Time. Setelah Anda memilih Rentang Waktu, menu pop-up akan menampilkan opsi berikut: Enter Selected Time Range, View Diagnostic Report for Selected Time Range, View Traces for Selected Time Range, dan View Logs for Selected Time Range.
Periksa trace dari Rentang Waktu yang dipilih.
Klik View traces for the selected time range.
Di panel daftar trace, pilih catatan trace yang Status-nya abnormal (ditandai dengan ikon
), lalu klik nilai TraceId di kolom TraceId.Anda juga dapat mengklik View Logs di kolom Actions catatan trace untuk melihat log bisnis pada waktu tersebut dan menganalisis penyebab exception bisnis.
Klik tab Traces , lalu di kolom Details, klik ikon
.Klik Method Stack, temukan pesan error di halaman detail trace, lalu arahkan kursor ke pesan error tersebut untuk melihat penyebab exception.
Sisi kiri halaman detail trace menampilkan pohon panggilan metode beserta jumlah pemanggilan dan durasinya. Sisi kanan menampilkan detail exception, termasuk jenis exception, seperti
java.lang.RuntimeException, dan pesan error spesifik, seperti "Failed to create Grafana folder".
Periksa log bisnis dari Rentang Waktu yang dipilih.
Klik View Logs for the Selected Time Range.
Di halaman Log Analysis, pilih informasi exception dan error untuk melihat log serta mengidentifikasi penyebab exception bisnis.
Sebagai contoh, Anda dapat memfilter entri log dengan menggunakan
traceId, melihat stack trace exception di detail log, dan mengidentifikasiRegisterPromClusterServletyang melemparkanjava.lang.RuntimeExceptiondengan akar penyebab Failed to create Grafana folder.
Troubleshoot exception dengan panggilan antarmuka
-
Login ke Konsol ARMS. Di panel navigasi sebelah kiri, pilih .
Pilih Wilayah di bilah navigasi atas dan klik aplikasi tersebut.
CatatanIkon di kolom Language menunjukkan bahasa pemrograman aplikasi:
: Java
: Go
: Python- (Hyphen): aplikasi yang dipantau di Managed Service for OpenTelemetry
Di bilah navigasi kiri, klik Interface Invocation.
Di halaman Interface Invocation, klik antarmuka target di area daftar antarmuka, lalu klik tab Call chain query.
Di tab Call chain query, pilih catatan panggilan antarmuka yang Status-nya gagal (ditampilkan sebagai
).Setelah difilter, daftar akan menampilkan catatan panggilan antarmuka yang abnormal. Tabel mencakup kolom
Generation Time,Interface Name,Application,Duration,Status,trace ID, danActions. Contoh ini menunjukkan tiga catatan denganStatusbernilai302, dan dua catatan dengan durasi 2,5 detik. Anda dapat mengklikView Logsdi kolomActionsuntuk menyelidiki detail panggilan tertentu.Lihat trace untuk panggilan antarmuka tersebut.
Di kolom TraceId catatan panggilan antarmuka target, klik TraceId-nya.
Klik tab Traces, lalu di kolom Details, klik ikon
.Klik Method Stack, temukan pesan error di halaman detail trace, lalu arahkan kursor ke pesan error tersebut untuk melihat penyebab exception.
Sisi kiri halaman detail trace menampilkan pohon panggilan metode beserta jumlah pemanggilan dan durasinya. Sisi kanan menampilkan detail exception, termasuk jenis exception, seperti
java.lang.RuntimeException, dan pesan error spesifik, seperti "Failed to create Grafana folder".
Lihat log untuk panggilan antarmuka tersebut.
Di kolom Actions catatan panggilan antarmuka target, klik View Logs.
Di halaman Log Analysis, pilih informasi exception dan error untuk melihat log serta mengidentifikasi penyebab exception bisnis.
Sebagai contoh, Anda dapat memfilter entri log dengan menggunakan
traceId, melihat stack trace exception di detail log, dan mengidentifikasiRegisterPromClusterServletyang melemparkanjava.lang.RuntimeExceptiondengan akar penyebab Failed to create Grafana folder.
Topik terkait
Anda juga dapat membuat alert untuk mendeteksi anomali metrik. Untuk informasi lebih lanjut, lihat Aturan alert Pemantauan Aplikasi.