Cria uma política de auto scaling para adicionar ou remover recursos de computação automaticamente com base em regras de dimensionamento configuradas para lidar com a carga de trabalho do seu cluster. Você pode especificar métricas e limites, ordem de dimensionamento, período de cooldown e muito mais.
Experimente agora
Testar
Autorização RAM
|
Ação |
Nível de acesso |
Tipo de recurso |
Chave de condição |
Ação dependente |
|
cs:CreateAutoscalingConfig |
create |
*Cluster.
|
Nenhuma | Nenhuma |
Sintaxe da solicitação
POST /cluster/{ClusterId}/autoscale/config/ HTTP/1.1
Parâmetros de caminho
|
Parâmetro |
Tipo |
Obrigatório |
Descrição |
Exemplo |
| ClusterId |
string |
Sim |
O ID do cluster. |
cdde1f21ae22e483ebcb068a6eb7f**** |
Parâmetros da solicitação
|
Parâmetro |
Tipo |
Obrigatório |
Descrição |
Exemplo |
| body |
object |
Não |
Os parâmetros do corpo da solicitação. |
|
| cool_down_duration |
string |
Não |
A duração do cooldown para eventos de scale-in. Este é o intervalo de tempo desde o momento em que o sistema detecta que um nó é elegível para um scale-in até o momento em que a operação de scale-in é executada. Valores válidos: 1 a 60. Unidade: minutos. Valor padrão: 10. |
10 |
| unneeded_duration |
string |
Não |
A janela de estabilização. Este é o período após um evento de scale-out durante o qual o scaler não executa operações de scale-in. Valores válidos: 1 a 60. Unidade: minutos. Valor padrão: 10. |
10 |
| utilization_threshold |
string |
Não |
O limite de utilização para um scale-in, que é a proporção de recursos solicitados em relação ao total de recursos alocáveis em um nó. Um nó é elegível para um scale-in somente quando tanto a utilização de CPU quanto a de memória caem abaixo desse limite. Valores válidos: [0.1, 1]. Valor padrão: 0.5 (50%). |
0.5 |
| gpu_utilization_threshold |
string |
Não |
O limite de utilização de GPU para um scale-in em nós de GPU, que é a proporção de recursos solicitados em relação ao total de recursos alocáveis em um nó. Um nó de GPU é elegível para um scale-in somente se a utilização de CPU, memória e GPU cair abaixo desse limite. Valores válidos: [0.1, 1]. Valor padrão: 0.3 (30%). |
0.3 |
| scan_interval |
string |
Não |
A frequência com a qual o sistema verifica as condições de dimensionamento. Valores válidos: 15, 30, 60, 120, 180 e 300. Unidade: segundos. Valor padrão: 60. |
30 |
| scale_down_enabled |
boolean |
Não |
Especifica se deve permitir operações de scale-in de nós. Valores válidos:
Valores válidos:
|
true |
| expander |
string |
Não |
A estratégia para selecionar um pool de nós para um scale-out quando vários pools de nós estão disponíveis. Valores válidos:
Valores válidos:
|
least-waste |
| skip_nodes_with_system_pods |
boolean |
Não |
Controla se o cluster-autoscaler pode executar scale-in em nós que executam Pods do namespace kube-system. Esta configuração não afeta DaemonSets ou mirror Pods. Valores válidos:
Valores válidos:
|
true |
| skip_nodes_with_local_storage |
boolean |
Não |
Controla se o cluster-autoscaler pode executar scale-in em nós que executam Pods usando armazenamento local (por exemplo, com volumes emptyDir ou hostPath). Valores válidos:
Valores válidos:
|
false |
| daemonset_eviction_for_nodes |
boolean |
Não |
Especifica se o cluster-autoscaler evicta Pods do DaemonSet dos nós durante um evento de scale-in. Valores válidos:
Valores válidos:
|
false |
| max_graceful_termination_sec |
integer |
Não |
A duração máxima em segundos que o cluster-autoscaler aguarda a finalização dos Pods durante a drenagem de um nó para um evento de scale-in. Unidade: segundos. Valor padrão: 14400. |
14400 |
| min_replica_count |
integer |
Não |
O número mínimo de Pods que devem permanecer para qualquer ReplicaSet após uma operação de scale-in. Os nós não sofrerão scale-in se isso violar esse mínimo. Valor padrão: 0. |
0 |
| recycle_node_deletion_enabled |
boolean |
Não |
Especifica se o objeto Node do Kubernetes deve ser excluído após um nó ser submetido a scale-in com sucesso usando o modo de dimensionamento rápido. Para obter mais informações, consulte Modos de dimensionamento. Valor padrão: false. Valores válidos:
Valores válidos:
|
false |
| scale_up_from_zero |
boolean |
Não |
Controla se o cluster-autoscaler executa uma operação de scale-out quando não há nós prontos no cluster. Valor padrão: true. Valores válidos:
Valores válidos:
|
true |
| scaler_type |
string |
Não |
O tipo de scaler a ser usado. Em clusters que executam o Kubernetes 1.24 ou posterior, o padrão é goatscaler. Em clusters que executam uma versão anterior, o padrão é cluster-autoscaler. Valores válidos:
Valores válidos:
|
goatscaler |
| priorities |
object |
Não |
Configura as prioridades para grupos de dimensionamento. Isso é usado quando a estratégia expander é definida como priority. Depois de criar um pool de nós e ativar o auto scaling para ele, você pode configurar a prioridade do seu grupo de dimensionamento associado. Para obter mais informações, consulte Ativar auto scaling de nós. A prioridade deve ser um número inteiro positivo de 1 a 100. Um valor maior indica uma prioridade mais alta. |
|
|
array |
Não |
Os IDs dos grupos de dimensionamento que têm a mesma prioridade. |
||
|
string |
Não |
O ID de um grupo de dimensionamento. |
asg-bp1fe63lqz****** |
Elementos de resposta
|
Elemento |
Tipo |
Descrição |
Exemplo |
|
object |
|||
| cluster_id |
string |
O ID do cluster. |
cc212d04dfe184547bffaa596******** |
| task_id |
string |
O ID da tarefa. |
T-5fd211e924e1d007******** |
| request_id |
string |
O ID da solicitação. |
AF8BE105-C32B-1269-9774-5510******** |
Exemplos
Resposta de sucesso
JSON formato
{
"cluster_id": "cc212d04dfe184547bffaa596********",
"task_id": "T-5fd211e924e1d007********",
"request_id": "AF8BE105-C32B-1269-9774-5510********"
}
Códigos de erro
Consulte Códigos de Erro para uma lista completa.
Notas de versão
Consulte Notas de Versão para uma lista completa.