Membuat konfigurasi penskalaan otomatis yang memungkinkan sistem untuk secara otomatis menambah atau mengurangi sumber daya komputasi berdasarkan aturan penskalaan yang dikonfigurasi guna memenuhi kebutuhan beban kerja klaster Anda. Selama proses pembuatan, Anda dapat menentukan metrik dan ambang batas penskalaan, urutan scale-out, periode pendinginan, dan lainnya.
Coba sekarang
Test
RAM authorization
|
Action |
Access level |
Resource type |
Condition key |
Dependent action |
|
cs:CreateAutoscalingConfig |
create |
*Cluster
|
None | None |
Sintaks permintaan
POST /cluster/{ClusterId}/autoscale/config/ HTTP/1.1
Path Parameters
|
Parameter |
Type |
Required |
Description |
Example |
| ClusterId |
string |
Yes |
ID klaster. |
cdde1f21ae22e483ebcb068a6eb7f**** |
Parameter permintaan
|
Parameter |
Type |
Required |
Description |
Example |
| body |
object |
No |
Parameter isi permintaan. |
|
| cool_down_duration |
string |
No |
Penundaan pemicu scale-down. Interval waktu antara saat kebutuhan scale-down terdeteksi (ambang batas scale-down tercapai) dan saat operasi scale-down (pengurangan jumlah pod) benar-benar dilakukan. Nilai yang valid: [1,60]. Satuan: menit. Nilai default: 10. |
10 |
| unneeded_duration |
string |
No |
Periode pendinginan. Interval waktu setelah scale-out terbaru di mana komponen penskalaan otomatis tidak melakukan operasi scale-down. Node yang ditambahkan selama scale-out hanya dapat dievaluasi untuk scale-down setelah periode pendinginan berlalu. Nilai yang valid: [1,60]. Satuan: menit. Nilai default: 10. |
10 |
| utilization_threshold |
string |
No |
Ambang batas scale-down. Rasio sumber daya yang diminta terhadap total sumber daya pada sebuah node. Sebuah node hanya dapat di-scale-down ketika rasio ini berada di bawah ambang batas yang dikonfigurasi, yang berarti penggunaan sumber daya CPU dan memori node berada di bawah ambang batas scale-down. Nilai yang valid: [0.1~1]. Nilai default: 0.5, yang menunjukkan 50%. |
0.5 |
| gpu_utilization_threshold |
string |
No |
Ambang batas scale-down GPU. Rasio sumber daya yang diminta terhadap total sumber daya pada sebuah node. Sebuah node GPU hanya dapat di-scale-down ketika rasio ini berada di bawah ambang batas yang dikonfigurasi, yang berarti penggunaan CPU, memori, dan GPU node semuanya berada di bawah ambang batas scale-down GPU. Nilai yang valid: [0.1~1]. Nilai default: 0.3, yang menunjukkan 30%. |
0.3 |
| scan_interval |
string |
No |
Sensitivitas penskalaan, yang mengatur interval di mana sistem mengevaluasi keputusan penskalaan. Nilai yang valid: 15, 30, 60, 120, 180, dan 300. Satuan: detik. Nilai default: 60. |
30 |
| scale_down_enabled |
boolean |
No |
Menentukan apakah scale-down node diizinkan. Nilai yang valid:
Valid values:
|
true |
| expander |
string |
No |
Kebijakan urutan scale-out node pool. Nilai yang valid:
Valid values:
|
least-waste |
| skip_nodes_with_system_pods |
boolean |
No |
Menentukan apakah cluster-autoscaler melewati scale-down untuk node yang menjalankan pod di namespace kube-system. Fitur ini tidak berlaku untuk pod DaemonSet atau mirror pod. Nilai yang valid:
Valid values:
|
true |
| skip_nodes_with_local_storage |
boolean |
No |
Menentukan apakah cluster-autoscaler melewati scale-down untuk node yang berisi pod dengan penyimpanan lokal (seperti EmptyDir atau HostPath). Nilai yang valid:
Valid values:
|
false |
| daemonset_eviction_for_nodes |
boolean |
No |
Menentukan apakah cluster-autoscaler mengeviksi pod DaemonSet pada node saat scale-down. Nilai yang valid:
Valid values:
|
false |
| max_graceful_termination_sec |
integer |
No |
Periode batas waktu yang ditunggu cluster-autoscaler untuk penghentian pod selama pengosongan node dalam skenario scale-down. Satuan: detik. Nilai default: 14400. |
14400 |
| min_replica_count |
integer |
No |
Jumlah minimum pod yang diizinkan dalam setiap ReplicaSet sebelum node dapat di-scale-down. Nilai default: 0. |
0 |
| recycle_node_deletion_enabled |
boolean |
No |
Menentukan apakah objek node Kubernetes yang sesuai akan dihapus setelah node berhasil di-scale-down dalam pola cepat. Untuk informasi lebih lanjut tentang pola cepat, lihat Pola penskalaan. Nilai default: false. Nilai yang valid:
Valid values:
|
false |
| scale_up_from_zero |
boolean |
No |
Menentukan apakah cluster-autoscaler melakukan scale-out ketika jumlah node siap dalam klaster adalah 0. Nilai default: true. Nilai yang valid:
Valid values:
|
true |
| scaler_type |
string |
No |
Jenis komponen penskalaan otomatis. Untuk klaster yang menjalankan versi 1.24 atau yang lebih baru, nilai default-nya adalah goatscaler. Untuk versi sebelumnya, nilai default-nya adalah cluster-autoscaler. Nilai yang valid:
Valid values:
|
goatscaler |
| priorities |
object |
No |
Konfigurasi prioritas untuk penskalaan otomatis. Setelah Anda membuat node pool dengan penskalaan otomatis diaktifkan, Anda dapat memilih apakah akan mengonfigurasi kebijakan prioritas dan pengaturan prioritas dengan menggunakan Mengaktifkan penskalaan otomatis untuk node untuk menetapkan prioritas ke scaling group dari node pool penskalaan otomatis yang ditentukan. Nilai yang valid: [1, 100]. Nilai harus berupa bilangan bulat positif. Nilai yang lebih besar menunjukkan prioritas yang lebih tinggi. |
|
|
array |
No |
ID scaling group node pool penskalaan otomatis dengan prioritas yang sama. |
||
|
string |
No |
ID scaling group node pool penskalaan otomatis. |
asg-bp1fe63lqz****** |
Elemen respons
|
Element |
Type |
Description |
Example |
|
object |
|||
| cluster_id |
string |
ID klaster. |
cc212d04dfe184547bffaa596******** |
| task_id |
string |
ID tugas. |
T-5fd211e924e1d007******** |
| request_id |
string |
ID permintaan. |
AF8BE105-C32B-1269-9774-5510******** |
Contoh
Respons sukses
JSONformat
{
"cluster_id": "cc212d04dfe184547bffaa596********",
"task_id": "T-5fd211e924e1d007********",
"request_id": "AF8BE105-C32B-1269-9774-5510********"
}
Kode kesalahan
Lihat Error Codes untuk daftar lengkap.
Catatan rilis
Lihat Release Notes untuk daftar lengkap.