Todos os produtos
Search
Central de documentação

Platform For AI:CreateServiceAutoScaler

Última atualização: Jul 08, 2026

Ativa o recurso Autoscaler e cria um controlador Autoscaler para um serviço.

Experimente agora

Experimente esta API no OpenAPI Explorer, sem necessidade de assinatura manual. Chamadas bem-sucedidas geram automaticamente código SDK correspondente aos seus parâmetros. Faça o download com segurança de credenciais integrada para uso local.

Testar

Autorização RAM

A tabela abaixo descreve a autorização necessária para chamar esta API. Você pode defini-la em uma política do Resource Access Management (RAM). As colunas da tabela estão detalhadas abaixo:

  • Ação: As ações que podem ser usadas no elemento Action das instruções de política de permissão do RAM para conceder permissões para executar a operação.

  • API: A API que você pode chamar para executar a ação.

  • Nível de acesso: O nível de acesso predefinido concedido para cada API. Valores válidos: create, list, get, update e delete.

  • Tipo de recurso: O tipo de recurso que suporta autorização para executar a ação. Indica se a ação suporta permissão em nível de recurso. O recurso especificado deve ser compatível com a ação. Caso contrário, a política será ineficaz.

    • Para APIs com permissões em nível de recurso, os tipos de recursos obrigatórios são marcados com um asterisco (*). Especifique o Nome de Recurso Alibaba Cloud (ARN) correspondente no elemento Resource da política.

    • Para APIs sem permissões em nível de recurso, é exibido como Todos os Recursos. Use um asterisco (*) no elemento Resource da política.

  • Chave de condição: As chaves de condição definidas pelo serviço. A chave permite controle granular, aplicando-se somente a ações ou a ações associadas a recursos específicos. Além das chaves de condição específicas do serviço, o Alibaba Cloud fornece um conjunto de chaves de condição comuns aplicáveis a todos os serviços compatíveis com RAM.

  • Ação dependente: As ações dependentes necessárias para executar a ação. Para concluir a ação, o usuário RAM ou a função RAM deve ter permissões para executar todas as ações dependentes.

Ação

Nível de acesso

Tipo de recurso

Chave de condição

Ação dependente

eas:CreateServiceAutoScaler

create

*Service

acs:eas:{#regionId}:{#accountId}:service/{#ServiceName}

Nenhuma Nenhuma

Sintaxe da solicitação

POST /api/v2/services/{ClusterId}/{ServiceName}/autoscaler HTTP/1.1

Parâmetros de caminho

Parâmetro

Tipo

Obrigatório

Descrição

Exemplo

ClusterId

string

Sim

O ID da região onde o serviço está implantado.

cn-shanghai

ServiceName

string

Sim

O nome do serviço. Para mais informações sobre como consultar o nome do serviço, consulte ListServices.

foo

Parâmetros da solicitação

Parâmetro

Tipo

Obrigatório

Descrição

Exemplo

body

object

Não

O corpo da solicitação.

min

integer

Sim

O número mínimo de instâncias no serviço.

2

max

integer

Sim

O número máximo de instâncias no serviço. O valor de max deve ser maior que o valor de min.

8

scaleStrategies

array<object>

Sim

O serviço para o qual a métrica é especificada. Se você não definir este parâmetro, o serviço atual será especificado por padrão.

object

Não

metricName

string

Sim

O nome da métrica para acionar o auto scaling. Valores válidos:

  • qps: as consultas por segundo (qps) para uma instância individual.

  • cpu: a utilização de cpu.

  • gpu[util]: a utilização de gpu.

qps

threshold

number

Sim

O limite da métrica que aciona o auto scaling.

  • Se você definir metricName como qps, o scale-out será acionado quando a qps média de uma única instância for maior que este limite.

  • Se você definir metricName como cpu, o scale-out será acionado quando a utilização média de cpu de uma única instância for maior que este limite.

  • Se você definir metricName como gpu, o scale-out será acionado quando a utilização média de gpu de uma única instância for maior que este limite.

10

service

string

Não

O serviço para o qual a métrica é especificada. Se você não definir este parâmetro, o serviço atual será especificado por padrão.

demo_svc

behavior

object

Não

A operação do Autoscaler.

scaleUp

object

Não

A operação de scale-out.

stabilizationWindowSeconds

integer

Não

The time window that is required before the scale-out operation is performed. The scale-out operation can be performed only if the specified metric exceeds the specified threshold in the specified time window. Default value: 0.

0

scaleDown

object

Não

A operação de scale-in.

stabilizationWindowSeconds

integer

Não

The time window that is required before the scale-in operation is performed. The scale-in operation can be performed only if the specified metric drops below the specified threshold in the specified time window. Default value: 300.

300

onZero

object

Não

A operação que reduz o número de instâncias para 0.

scaleDownGracePeriodSeconds

integer

Não

The time window that is required before the number of instances is reduced to 0. The number of instances can be reduced to 0 only if no request is available or no traffic exists in the specified time window. Default value: 600.

600

scaleUpActivationReplicas

integer

Não

The number of instances that you want to create at a time if the number of instances is 0. Default value: 1.

1

Elementos de resposta

Elemento

Tipo

Descrição

Exemplo

object

Os parâmetros de resposta.

RequestId

string

O ID da solicitação.

40325405-579C-4D82****

Message

string

A mensagem retornada.

Succeed to auto scale service [foo]

Exemplos

Resposta de sucesso

JSON formato

{
  "RequestId": "40325405-579C-4D82****",
  "Message": "Succeed to auto scale service [foo]"
}

Códigos de erro

Consulte Códigos de Erro para uma lista completa.

Notas de versão

Consulte Notas de Versão para uma lista completa.