Respons aplikasi yang lambat dapat berasal dari berbagai titik sepanjang jalur permintaan—antarmuka depan, gerbang, server aplikasi, atau database. Dalam arsitektur layanan mikro, satu permintaan melibatkan beberapa layanan yang dikelola oleh tim berbeda, sehingga mencatat setiap potensi bottleneck secara manual menjadi sangat mahal.
Pemantauan Aplikasi di ARMS (Application Real-Time Monitoring Service) mengatasi tantangan ini dengan melacak secara otomatis setiap antarmuka yang diekspos oleh aplikasi Anda dan menandai panggilan lambat—tanpa perubahan kode. Setelah Anda menginstal agen ARMS, agen tersebut terus-menerus melakukan profiling aplikasi, menangkap jejak terdistribusi, serta memantau kinerja antarmuka.
Panduan ini akan memandu Anda melalui alur kerja pemecahan masalah: periksa metrik kesehatan, identifikasi antarmuka lambat, lalu telusuri jejak dan stack metode untuk menemukan akar permasalahan.
Prasyarat
Sebelum memulai, pastikan Anda telah:
Memiliki Akun Alibaba Cloud dengan ARMS yang telah diaktifkan
Memiliki aplikasi yang terhubung ke Pemantauan Aplikasi ARMS dengan agen ARMS yang telah diinstal. Untuk metode instalasi, lihat Ikhtisar Pemantauan Aplikasi
Langkah 1: Periksa metrik kesehatan aplikasi dan SQL lambat
Halaman Application Overview memberikan snapshot kesehatan aplikasi Anda. Halaman ini melacak metrik berikut serta menampilkan tren harian dan mingguan:
| Metric | Apa yang ditunjukkan |
|---|---|
| Waktu respons rata-rata | Latensi keseluruhan yang dialami pemanggil |
| Total permintaan | Volume lalu lintas selama periode yang dipilih |
| Kesalahan | Permintaan gagal yang mungkin mengindikasikan bug atau masalah downstream |
| Instans real-time | Jumlah instans aplikasi aktif |
| Kejadian Full GC | Jeda garbage collection yang dapat menyebabkan tersendat |
| Kueri SQL lambat | Kueri database yang melebihi ambang batas lambat |
| Pengecualian | Pengecualian runtime yang dilemparkan oleh aplikasi |
| Panggilan lambat | Panggilan antarmuka yang melebihi ambang batas waktu respons |
Masuk ke Konsol ARMS. Di panel navigasi kiri, pilih Application Monitoring > Application List.
Di halaman Application List, pilih Wilayah di bilah navigasi atas, lalu klik nama aplikasi Anda.
CatatanJika ikon
muncul di kolom Language, berarti aplikasi terhubung ke Pemantauan Aplikasi. Jika tanda hubung (-) muncul, berarti aplikasi terhubung ke Managed Service for OpenTelemetry.Di halaman Application Overview, klik tab Overview. Tab ini menampilkan jumlah total kueri SQL lambat beserta perubahan harian dan mingguan. Peningkatan jumlah SQL lambat sering kali mengindikasikan bottleneck terkait database yang perlu segera diselidiki.
Langkah 2: Identifikasi antarmuka lambat
Halaman Interface Invocation mencantumkan semua antarmuka yang diekspos oleh aplikasi Anda, lengkap dengan jumlah panggilan dan waktu responsnya. ARMS menandai antarmuka lambat sehingga Anda dapat dengan cepat mengidentifikasi titik akhir yang perlu diperhatikan.
Di panel navigasi kiri, klik Interface Invocation.
Di panel kiri, klik antarmuka lambat untuk melihat detailnya. Fokuslah pada antarmuka dengan waktu respons tinggi atau jumlah panggilan lambat yang besar karena kemungkinan besar menjadi sumber latensi yang dirasakan pengguna.
Setelah membuka halaman Interface Invocation, tab Overview akan ditampilkan secara default. Panel kiri mencantumkan semua antarmuka beserta waktu respons, jumlah permintaan, jumlah kesalahan, dan jumlah pengecualian. Panel kanan menampilkan empat grafik pemantauan: Requests/Minute, Response Time/Minute, Slow Calls/Minute, dan HTTP Status Code Statistics. Di daftar antarmuka kiri, urutkan berdasarkan waktu respons untuk menemukan antarmuka panggilan lambat dengan latensi tinggi.
Langkah 3: Temukan kode bermasalah melalui detail jejak
Setelah mengidentifikasi antarmuka lambat, telusuri jejaknya untuk menemukan kode spesifik yang menjadi penyebabnya. Snapshot antarmuka menangkap catatan jejak lengkap—setiap panggilan dalam rantai dan durasinya—sehingga Anda dapat menentukan dengan tepat di mana waktu dihabiskan.
Di sisi kanan halaman Interface Invocation, klik tab Interface snapshot. Tab ini menampilkan semua jejak yang telah ditangkap untuk antarmuka yang dipilih.
Klik ID jejak untuk membuka detail jejak.
Di panel detail jejak, tinjau hierarki panggilan dan rincian waktunya. Di kolom Details, klik ikon kaca pembesar untuk memeriksa stack metode dan informasi konteks.
CatatanUntuk cara lain dalam melakukan kueri dan memfilter jejak, lihat Trace query.
Setelah mengidentifikasi akar permasalahan dari panggilan lambat tertentu, kembali ke halaman Interface Invocation dan ulangi proses ini untuk antarmuka lambat lainnya dalam daftar.
Konfigurasi peringatan untuk pemantauan berkelanjutan
Untuk mendeteksi regresi kinerja sedini mungkin, konfigurasikan aturan peringatan untuk satu atau beberapa antarmuka. Saat terjadi pengecualian, ARMS secara otomatis mengirim pemberitahuan peringatan ke tim operasional Anda.
Untuk detailnya, lihat Aturan peringatan Pemantauan Aplikasi.