Todos os produtos
Search
Central de documentação

:Configure o Auto Scaling

Última atualização: Jul 09, 2026

Chame a operação CreateAutoscalingConfig para configure o Auto Scaling.

Depuração

O OpenAPI Explorer calcula automaticamente o valor da assinatura. Para sua conveniência, recomendamos chamar esta operação no OpenAPI Explorer. O OpenAPI Explorer gera dinamicamente códigos de exemplo da operação para diferentes SDKs.

Cabeçalhos da requisição

Esta operação usa apenas cabeçalhos de requisição comuns. Para mais informações, consulte a documentação de parâmetros de requisição comuns.

Sintaxe da requisição

POST /cluster/{ClusterId}/autoscale/config/ HTTP/1.1

Parâmetros da requisição

ParâmetroTipoPosiçãoObrigatórioExemploDescrição
ClusterIdStringPathSimc0XXXXXXX10

ID do cluster a ser gerencie.

ObjectBodyNão

Corpo da requisição.

cool_down_durationStringBodyNão10

Período de resfriamento do Auto Scaling. Nós adicionados por esse recurso não podem ser removidos antes do término desse período. Unidade: minutos.

unneeded_durationStringBodyNão10

Tempo de espera antes de o Auto Scaling executar uma atividade de scale-in. O nó será removido somente se o uso de recursos permanecer abaixo do limiar de scale-in durante todo o tempo de espera. Unidade: minutos.

utilization_thresholdStringBodyNão0.5

Limiar de scale-in. Especifica a proporção entre os recursos solicitados pelos pods e o total de recursos no nó.

gpu_utilization_thresholdStringBodyNão0.5

Limiar de scale-in para utilização de GPU. Define a razão entre os recursos de GPU solicitados pelos pods e o total de recursos de GPU no nó.

scan_intervalStringBodyNão30

Intervalo de verificação e avaliação do cluster para dimensionamento. Unidade: segundos.

scale_down_enabledBooleanBodyNãotrue

Define se o scale-in de nós é permitido. Valores válidos:

  • true: permite o scale-in de nós.
  • false: não permite o scale-in de nós.
expanderStringBodyNãoleast-waste

Política de seleção de node pools para atividades de scale-out. Valores válidos:

  • least-waste: política padrão. Se vários node pools atenderem ao requisito, seleciona aquele com menos recursos ociosos após a conclusão do scale-out.
  • random: política aleatória. Se múltiplos node pools forem elegíveis, escolhe um deles aleatoriamente para o scale-out.
  • priority : política baseada em prioridade. Se diversos node pools satisfizerem o requisito, seleciona aquele com a maior prioridade para o scale-out.

    As prioridades dos node pools são definidas no ConfigMap cluster-autoscaler-priority-expander no namespace kube-system. Ao acionar uma atividade de scale-out, a política obtém a prioridade do node pool no ConfigMap pelo ID e seleciona o de maior prioridade para a expansão.

Sem parâmetros de resposta.

Exemplos

Exemplos de requisições

POST /cluster/c0XXXXXXX10/autoscale/config HTTP/1.1
Host:cs.aliyuncs.com
Content-Type:application/json

{
  "cool_down_duration" : "10m",
  "unneeded_duration" : "10m",
  "utilization_threshold" : "0.5",
  "gpu_utilization_threshold" : "0.5",
  "scan_interval" : "30s"
}

Exemplos de respostas de sucesso

Formato JSON

HTTP/1.1 200 OK

Códigos de erro

Para obter uma lista de códigos de erro, visite o API Error Center.