Isolasi atau perbaiki disk lokal yang rusak pada instance ECS melalui Konsol atau API setelah menerima event kerusakan disk.
Mengisolasi atau memperbaiki disk menyebabkan kehilangan data yang tidak dapat dipulihkan pada disk lokal yang rusak. Backup data Anda terlebih dahulu.
Selama isolasi atau perbaikan disk, Anda dapat mendeploy ulang instance dengan disk lokal untuk mengembalikan penggunaan disk penuh, tetapi semua data disk akan hilang.
Ikhtisar prosedur
-
Modifikasi file konfigurasi: Untuk instance Linux, login ke instance, modifikasi file /etc/fstab, dan unmount disk lokal yang rusak untuk mencegah operasi baca/tulis pada disk yang salah selama penggantian.
-
Isolasi disk yang rusak: Isolasi disk lokal yang rusak. Instance tetap beroperasi secara normal setelah isolasi.
-
Ganti disk: Alibaba Cloud mengganti disk yang rusak.
-
Pulihkan disk: Login ke instance ECS, modifikasi file /etc/fstab, dan mount disk lokal yang baru.
Hanya keluarga instans big data d1, d2, dan d3 serta keluarga instans SSD lokal i4 yang mendukung isolasi dan penggantian disk online. Keluarga instans SSD lokal i3 dan i2 mendukung isolasi tetapi tidak mendukung penggantian. Langkah-langkah aktual yang ditampilkan di halaman bergantung pada tingkat kerusakan disk.
Prosedur
Modifikasi file konfigurasi (khusus Linux)
Lewati langkah ini jika instance Anda tidak menjalankan Linux. Untuk instance Linux, modifikasi file /etc/fstab dan unmount disk lokal yang rusak sebelum isolasi:
Isolasi disk yang rusak
ECS console
-
Buka ECS Console-Events.
-
Di panel navigasi kiri halaman Event, klik . Klik Repair di kolom Actions pada event target.
-
Di langkah Configurations Modification, pastikan Anda telah memodifikasi file konfigurasi, lalu klik Next.
Halaman menunjukkan bahwa Anda perlu memodifikasi file konfigurasi /etc/fstab di sistem operasi instance ECS dan unmount perangkat disk untuk menghindari risiko terkait operasi penggantian disk.
-
Di langkah Isolate Damaged Disk, klik OK. Tunggu hingga isolasi selesai. Jika halaman menampilkan langkah Instance Restart, restart instance tersebut.
CatatanJika langkah berikutnya tidak muncul dalam beberapa menit, refresh halaman.
Operasi API
-
Kueri peristiwa sistem.
Panggil DescribeInstanceHistoryEvents untuk menanyakan event sistem dalam status Inquiring (
Inquiring) di wilayah yang ditentukan. Catat EventId (EventId) dan nama event (Name) yang dikembalikan. -
Otorisasi dan jalankan isolasi disk yang rusak.
Panggil AcceptInquiredSystemEvent untuk mengotorisasi isolasi disk.
-
Ketika nama event adalah
SystemMaintenance.IsolateErrorDisk:-
Jika hanya RequestId yang dikembalikan, restart tidak diperlukan. Tunggu Alibaba Cloud mengganti disk tersebut.
-
Jika dikembalikan
code:SwitchToOffline.OnlineIsolateFail, restart instance.
-
-
Ketika nama event adalah
SystemMaintenance.RebootAndIsolateErrorDisk: Setelah memanggil AcceptInquiredSystemEvent, restart instance.
-
Setelah restart, disk lokal yang rusak dan diisolasi menjadi disk dummy berukuran 1 MiB. Terus hindari operasi baca/tulis pada disk yang rusak di lapisan aplikasi dan pertahankan pengaturan nofail dan barrier di /etc/fstab.
Ganti disk
Tidak perlu tindakan apa pun. Tunggu Alibaba Cloud mengganti disk lokal yang rusak. Penggantian diperkirakan selesai dalam lima hari kerja. Periksa progresnya di halaman Local Disk Events.
Pulihkan disk
ECS console
-
Ketika Disk Repair Progress berubah menjadi To Be Restored, yang menandakan event berada dalam tahap Restore, klik Repair di kolom Actions, lalu klik Restore di kotak dialog.
-
Jika halaman menampilkan langkah Restart, restart instance tersebut.
-
Ketika Disk Repair Progress berubah menjadi Handled, event telah sepenuhnya diproses.
API
-
Kueri event sistem.
Panggil DescribeInstanceHistoryEvents untuk menanyakan event sistem. Setelah penggantian disk, Alibaba Cloud menerbitkan event
SystemMaintenance.ReInitErrorDiskatauSystemMaintenance.RebootAndReInitErrorDisk. -
Otorisasi pemulihan disk.
Panggil AcceptInquiredSystemEvent untuk mengotorisasi pemulihan disk.
-
Ketika nama event adalah
SystemMaintenance.ReinitErrorDisk:-
Jika hanya RequestId yang dikembalikan, restart tidak diperlukan.
-
Jika dikembalikan
code=SwitchToOffline.OnlineReInitFail, restart instance.
-
-
Ketika nama event adalah
SystemMaintenance.RebootAndReinitErrorDisk: Setelah memanggil AcceptInquiredSystemEvent, restart instance.
-
Langkah selanjutnya
Setelah perbaikan, periksa status instance ECS dan disk lokal. Disk lokal yang diganti harus diinisialisasi sebelum digunakan. Lihat Initialize Windows data disk atau Initialize Linux data disk.