Todos os produtos
Search
Central de documentação

Container Service for Kubernetes:CreateAutoscalingConfig

Última atualização: Jun 29, 2026

Cria uma política de auto scaling para adicionar ou remover recursos de computação automaticamente com base em regras de dimensionamento configuradas para lidar com a carga de trabalho do seu cluster. Você pode especificar métricas e limites, ordem de dimensionamento, período de cooldown e muito mais.

Experimente agora

Experimente esta API no OpenAPI Explorer, sem necessidade de assinatura manual. Chamadas bem-sucedidas geram automaticamente código SDK correspondente aos seus parâmetros. Faça o download com segurança de credenciais integrada para uso local.

Testar

Autorização RAM

A tabela abaixo descreve a autorização necessária para chamar esta API. Você pode defini-la em uma política do Resource Access Management (RAM). As colunas da tabela estão detalhadas abaixo:

  • Ação: As ações que podem ser usadas no elemento Action das instruções de política de permissão do RAM para conceder permissões para executar a operação.

  • API: A API que você pode chamar para executar a ação.

  • Nível de acesso: O nível de acesso predefinido concedido para cada API. Valores válidos: create, list, get, update e delete.

  • Tipo de recurso: O tipo de recurso que suporta autorização para executar a ação. Indica se a ação suporta permissão em nível de recurso. O recurso especificado deve ser compatível com a ação. Caso contrário, a política será ineficaz.

    • Para APIs com permissões em nível de recurso, os tipos de recursos obrigatórios são marcados com um asterisco (*). Especifique o Nome de Recurso Alibaba Cloud (ARN) correspondente no elemento Resource da política.

    • Para APIs sem permissões em nível de recurso, é exibido como Todos os Recursos. Use um asterisco (*) no elemento Resource da política.

  • Chave de condição: As chaves de condição definidas pelo serviço. A chave permite controle granular, aplicando-se somente a ações ou a ações associadas a recursos específicos. Além das chaves de condição específicas do serviço, o Alibaba Cloud fornece um conjunto de chaves de condição comuns aplicáveis a todos os serviços compatíveis com RAM.

  • Ação dependente: As ações dependentes necessárias para executar a ação. Para concluir a ação, o usuário RAM ou a função RAM deve ter permissões para executar todas as ações dependentes.

Ação

Nível de acesso

Tipo de recurso

Chave de condição

Ação dependente

cs:CreateAutoscalingConfig

create

*Cluster.

acs:cs:{#regionId}:{#accountId}:cluster/{#ClusterId}

Nenhuma Nenhuma

Sintaxe da solicitação

POST /cluster/{ClusterId}/autoscale/config/ HTTP/1.1

Parâmetros de caminho

Parâmetro

Tipo

Obrigatório

Descrição

Exemplo

ClusterId

string

Sim

O ID do cluster.

cdde1f21ae22e483ebcb068a6eb7f****

Parâmetros da solicitação

Parâmetro

Tipo

Obrigatório

Descrição

Exemplo

body

object

Não

Os parâmetros do corpo da solicitação.

cool_down_duration

string

Não

A duração do cooldown para eventos de scale-in. Este é o intervalo de tempo desde o momento em que o sistema detecta que um nó é elegível para um scale-in até o momento em que a operação de scale-in é executada.

Valores válidos: 1 a 60. Unidade: minutos.

Valor padrão: 10.

10

unneeded_duration

string

Não

A janela de estabilização. Este é o período após um evento de scale-out durante o qual o scaler não executa operações de scale-in.

Valores válidos: 1 a 60. Unidade: minutos.

Valor padrão: 10.

10

utilization_threshold

string

Não

O limite de utilização para um scale-in, que é a proporção de recursos solicitados em relação ao total de recursos alocáveis em um nó.

Um nó é elegível para um scale-in somente quando tanto a utilização de CPU quanto a de memória caem abaixo desse limite.

Valores válidos: [0.1, 1].

Valor padrão: 0.5 (50%).

0.5

gpu_utilization_threshold

string

Não

O limite de utilização de GPU para um scale-in em nós de GPU, que é a proporção de recursos solicitados em relação ao total de recursos alocáveis em um nó.

Um nó de GPU é elegível para um scale-in somente se a utilização de CPU, memória e GPU cair abaixo desse limite.

Valores válidos: [0.1, 1].

Valor padrão: 0.3 (30%).

0.3

scan_interval

string

Não

A frequência com a qual o sistema verifica as condições de dimensionamento.

Valores válidos: 15, 30, 60, 120, 180 e 300. Unidade: segundos.

Valor padrão: 60.

30

scale_down_enabled

boolean

Não

Especifica se deve permitir operações de scale-in de nós. Valores válidos:

  • true: Permite operações de scale-in.

  • false: Desativa operações de scale-in.

Valores válidos:

  • true :

    true.

  • false :

    false.

true

expander

string

Não

A estratégia para selecionar um pool de nós para um scale-out quando vários pools de nós estão disponíveis. Valores válidos:

  • least-waste: A estratégia padrão. O scaler seleciona o pool de nós que terá menos recursos ociosos após um scale-out.

  • random: O scaler seleciona um pool de nós aleatório da lista de pools de nós elegíveis.

  • priority: O scaler seleciona o pool de nós que tem a maior prioridade. Você deve configurar a prioridade de cada grupo de dimensionamento usando o parâmetro priorities.

Valores válidos:

  • random :

    random.

  • least-waste :

    least-waste.

  • priority :

    priority.

least-waste

skip_nodes_with_system_pods

boolean

Não

Controla se o cluster-autoscaler pode executar scale-in em nós que executam Pods do namespace kube-system. Esta configuração não afeta DaemonSets ou mirror Pods. Valores válidos:

  • true: Impede que esses nós sofram scale-in.

  • false: Permite que esses nós sofram scale-in.

Valores válidos:

  • true :

    true.

  • false :

    false.

true

skip_nodes_with_local_storage

boolean

Não

Controla se o cluster-autoscaler pode executar scale-in em nós que executam Pods usando armazenamento local (por exemplo, com volumes emptyDir ou hostPath). Valores válidos:

  • true: Impede que esses nós sofram scale-in.

  • false: Permite que esses nós sofram scale-in.

Valores válidos:

  • true :

    true.

  • false :

    false.

false

daemonset_eviction_for_nodes

boolean

Não

Especifica se o cluster-autoscaler evicta Pods do DaemonSet dos nós durante um evento de scale-in. Valores válidos:

  • true: Realiza a evicção.

  • false: Não realiza a evicção.

Valores válidos:

  • true :

    true.

  • false :

    false.

false

max_graceful_termination_sec

integer

Não

A duração máxima em segundos que o cluster-autoscaler aguarda a finalização dos Pods durante a drenagem de um nó para um evento de scale-in.

Unidade: segundos.

Valor padrão: 14400.

14400

min_replica_count

integer

Não

O número mínimo de Pods que devem permanecer para qualquer ReplicaSet após uma operação de scale-in. Os nós não sofrerão scale-in se isso violar esse mínimo.

Valor padrão: 0.

0

recycle_node_deletion_enabled

boolean

Não

Especifica se o objeto Node do Kubernetes deve ser excluído após um nó ser submetido a scale-in com sucesso usando o modo de dimensionamento rápido. Para obter mais informações, consulte Modos de dimensionamento. Valor padrão: false. Valores válidos:

  • true: O objeto Node é excluído após a instância ser parada. Não recomendamos esta configuração, pois pode causar inconsistências de dados no Kubernetes.

  • false: O objeto Node é retido após a instância ser parada.

Valores válidos:

  • true :

    true.

  • false :

    false.

false

scale_up_from_zero

boolean

Não

Controla se o cluster-autoscaler executa uma operação de scale-out quando não há nós prontos no cluster. Valor padrão: true. Valores válidos:

  • true: Uma operação de scale-out é executada.

  • false: Nenhuma operação de scale-out é executada.

Valores válidos:

  • true :

    true.

  • false :

    false.

true

scaler_type

string

Não

O tipo de scaler a ser usado. Em clusters que executam o Kubernetes 1.24 ou posterior, o padrão é goatscaler. Em clusters que executam uma versão anterior, o padrão é cluster-autoscaler. Valores válidos:

  • goatscaler: O scaler proprietário para dimensionamento rápido.

  • cluster-autoscaler: O autoscaler de cluster padrão do Kubernetes.

Valores válidos:

  • goatscaler :

    goatscaler.

  • cluster-autoscaler :

    cluster-autoscaler.

goatscaler

priorities

object

Não

Configura as prioridades para grupos de dimensionamento. Isso é usado quando a estratégia expander é definida como priority. Depois de criar um pool de nós e ativar o auto scaling para ele, você pode configurar a prioridade do seu grupo de dimensionamento associado. Para obter mais informações, consulte Ativar auto scaling de nós.

A prioridade deve ser um número inteiro positivo de 1 a 100. Um valor maior indica uma prioridade mais alta.

array

Não

Os IDs dos grupos de dimensionamento que têm a mesma prioridade.

string

Não

O ID de um grupo de dimensionamento.

asg-bp1fe63lqz******

Elementos de resposta

Elemento

Tipo

Descrição

Exemplo

object

cluster_id

string

O ID do cluster.

cc212d04dfe184547bffaa596********

task_id

string

O ID da tarefa.

T-5fd211e924e1d007********

request_id

string

O ID da solicitação.

AF8BE105-C32B-1269-9774-5510********

Exemplos

Resposta de sucesso

JSON formato

{
  "cluster_id": "cc212d04dfe184547bffaa596********",
  "task_id": "T-5fd211e924e1d007********",
  "request_id": "AF8BE105-C32B-1269-9774-5510********"
}

Códigos de erro

Consulte Códigos de Erro para uma lista completa.

Notas de versão

Consulte Notas de Versão para uma lista completa.