Lakukan restart kluster atau node individual untuk menerapkan perubahan konfigurasi atau menangani exception. Setiap metode restart memiliki prasyarat dan tingkat risiko yang berbeda.
Pemeriksaan sebelum restart
Lakukan pemeriksaan berikut sebelum melakukan restart.
Penggunaan disk yang tinggi memperlambat proses restart. Kurangi penggunaan disk di bawah ambang batas cluster.routing.allocation.disk.watermark.low sebelum melakukan restart. Jangan lakukan skala keluar, restart, perubahan password, atau perubahan konfigurasi lainnya hingga status kluster kembali menjadi green.
-
Periksa status kesehatan kluster
Terhubung ke kluster melalui Kibana dan jalankanGET _cluster/health. Pastikan bahwastatusadalahgreen.Pengecualian: Restart paksa hanya tersedia ketika status adalah
yellowataured. -
Pastikan redundansi data
JalankanGET _cat/indices?vuntuk memeriksarep(jumlah replica) untuk semua indeks kritis.-
Jumlah replica harus minimal
1. Indeks tanpa replica tidak dapat diakses selama restart. -
Untuk instans multi-zona, jumlah replica harus kurang dari jumlah zona.
-
-
Periksa dan tangani indeks yang ditutup
JalankanGET _cat/indices?vuntuk memeriksa indeks denganstatus=close.-
Indeks yang ditutup menghalangi alokasi shard dan proses restart.
-
Untuk membuka indeks yang ditutup, jalankan
POST /<index_name>/_open.
-
-
Nilai beban kluster
Di halaman Cluster Monitoring, pastikan kapasitas mencukupi untuk migrasi shard:-
Penggunaan CPU Node: di bawah 80%
-
Penggunaan Memori Heap Node: sekitar 50%
-
NodeLoad_1m: di bawah jumlah core CPU
-
Prosedur
Setelah pemeriksaan kesehatan berhasil, lakukan restart kluster:
-
Masuk ke Konsol Alibaba Cloud Elasticsearch. Di panel navigasi kiri, klik Elasticsearch Clusters.
-
Di bilah navigasi atas, pilih wilayah. Klik ID instans target, lalu klik Restart di pojok kanan atas halaman Basic Information.

-
Pada kotak dialog Restart, konfigurasikan parameter berikut:

-
Object
-
Cluster: Melakukan restart semua node dalam kluster. Cocok untuk perubahan tingkat kluster.
-
Node Restart: Melakukan restart satu atau beberapa node tertentu. Cocok untuk menangani masalah pada node individual.
-
Node Role (Hanya untuk arsitektur basic control v2): Melakukan restart node dengan role tertentu yang Anda pilih, seperti node data atau node Kibana.
-
-
Blue-green Update dan Restart Mode
Pilih metode restart berdasarkan skenario, status kluster, dan toleransi risiko Anda:
Metode restart
Status Kluster yang Diperlukan
Mekanisme dan skenario
Dampak
Batasan
Blue-green Update
Normal (green)
Menyediakan node baru, memigrasikan data dari node lama, lalu menghapus node lama.
Gunakan ketika suatu node mengalami beban CPU tinggi secara persisten dan ketersediaan lebih penting daripada kecepatan.
PentingUpdate blue-green tidak dapat digunakan bersamaan dengan restart paksa.
IP node berubah. Performa mungkin berfluktuasi sebentar.
Tidak didukung untuk spesifikasi kluster 1 vCPU 2 GB
Restart (Standard)
Normal (green)
Maintenance terencana dan konfigurasi kluster rutin.
IP node tetap tidak berubah. Proses lebih lama. Layanan tetap tersedia jika ada replica, tetapi mungkin berfluktuasi sebentar.
Phased Restart
Normal (green)
Memverifikasi efek restart secara bertahap untuk mengurangi risiko di lingkungan produksi.
Pilih node untuk batch pertama. Setelah kluster stabil, picu secara manual node yang tersisa.
IP node tetap tidak berubah. Meminimalkan dampak pada produksi.
Hanya tersedia untuk kluster dengan arsitektur cloud-native control (v3)
Forced Restart
Tidak normal (yellow/red)
Gunakan ketika kluster berstatus yellow atau red. Metode restart lain dinonaktifkan dalam kondisi ini.
IP node tetap tidak berubah.
Konkurensi tinggi mempercepat restart tetapi meningkatkan risiko:
-
Konkurensi 100% merestart semua node secara simultan, menyebabkan gangguan layanan dan potensi kehilangan data cache yang belum dipersist.
-
Gunakan konkurensi tinggi hanya untuk pemulihan mendesak.
Konkurensi: Persentase node yang direstart secara simultan. Nilai default 10%, minimal 1 node.
Hanya ditampilkan dalam mode forced restart.
-
-
-
(Opsional) Untuk forced restart, pilih Restart Cluster Forcibly.
-
Klik OK.
Status kluster berubah menjadi Initializing. Status akan kembali menjadi Normal setelah selesai.
Verifikasi pasca-restart
Verifikasi kesehatan kluster dan pantau pemulihan shard setelah restart:
-
Periksa kesehatan kluster:
GET _cluster/health -
Pantau node dan pemulihan shard:
GET _cat/nodes GET _cat/recovery -
Tunggu hingga semua shard dialokasikan sebelum melanjutkan operasi.