Todos os produtos
Search
Central de documentação

Platform For AI:Pool de recursos elásticos

Última atualização: Jun 27, 2026

O pool de recursos elásticos é uma estratégia de agendamento híbrido de recursos no nível de serviço oferecida pelo EAS. Esse recurso permite que serviços implantados em um grupo de recursos dedicado transfiram automaticamente novas réplicas para um grupo de recursos público com pagamento conforme o uso durante picos de tráfego, quando os recursos dedicados são insuficientes. Assim, seu serviço mantém a capacidade de dimensionamento elástico.

Benefícios

  • Superação dos limites de capacidade do grupo de recursos: Quando os recursos do grupo dedicado se esgotam, o scale-out do serviço utiliza automaticamente instâncias sob demanda do pool de recursos público. Isso garante que o dimensionamento automático horizontal (baseado em métricas como QPS ou CPU) não fique limitado pela quantidade de nós físicos no grupo de recursos dedicado.

  • Otimização de custos: Utilize recursos de assinatura de baixo custo para lidar com o tráfego base e consuma recursos sob demanda apenas durante períodos de pico. Essa abordagem evita a manutenção de recursos dedicados redundantes a longo prazo apenas para cobrir cargas máximas, reduzindo os custos gerais.

Como funciona

O pool de recursos elásticos utiliza uma ordem de prioridade clara para o agendamento, equilibrando custo e estabilidade.

  • Scale-out

    1. Quando um serviço aciona o scale-out, o agendador do EAS tenta primeiro criar novas instâncias dentro do grupo de recursos dedicado do serviço.

    2. Se o grupo de recursos dedicado não tiver recursos suficientes — como ausência de nós disponíveis ou insuficiência de CPU, memória ou GPU restante —, o agendador cria novas instâncias no grupo de recursos público usando a especificação de recurso (tipo de instância) definida por você ao configurar o pool de recursos elásticos.

  • Scale-in

    1. Ao acionar o scale-in, o sistema seleciona e encerra preferencialmente as instâncias em execução no grupo de recursos público.

    2. Somente após o scale-in de todas as instâncias elásticas no grupo de recursos público, o sistema inicia o scale-in das instâncias do grupo de recursos dedicado. Esse mecanismo assegura que os recursos elásticos de maior custo sejam liberados primeiro, preservando as instâncias base mais estáveis.

Pré-requisitos

Crie um grupo de recursos dedicado. Para mais informações, consulte Usar grupos de recursos do EAS.

Métodos de configuração

Ativar o pool de recursos elásticos durante a implantação do serviço

Configuração via console

  1. Faça login no PAI console. Selecione uma região na parte superior da página. Em seguida, selecione o workspace desejado e clique em Elastic Algorithm Service (EAS).

  2. Clique em Deploy Service. Na seção Custom Model Deployment, clique em Custom Deployment.

  3. Na página Custom Deployment, vá até a seção Resource Information e configure os seguintes parâmetros principais. Para outros parâmetros, consulte Implantação personalizada.

    Parâmetro

    Descrição

    Resource Type

    Selecione EAS Resource Group.

    Resource Group

    Escolha um grupo de recursos dedicado existente.

    Elastic Resource Pool

    Ative a chave Elastic Resource Pool e selecione uma Resource Specification.

    Após configurar o pool de recursos elásticos, se os recursos da máquina ficarem insuficientes durante o scale-out, as novas instâncias criadas serão iniciadas automaticamente nos recursos públicos configurados com pagamento conforme o uso e faturadas no grupo de recursos público. Durante o scale-in, as instâncias do grupo de recursos público são reduzidas primeiro.

  4. Clique em Deploy.

Configuração via JSON

Os parâmetros principais para ativar o pool de recursos elásticos estão listados abaixo. Para outros parâmetros, consulte Implantação via JSON.

  • resource_burstable: Defina como true para ativar o pool de recursos elásticos.

  • cloud.networking: Para garantir a disponibilidade da rede durante o dimensionamento elástico, configure a virtual private cloud (VPC) do serviço usando este campo ao ativar o pool de recursos elásticos.

    Importante

    Ao usar um grupo de recursos dedicado, é possível configurar uma virtual private cloud no nível do grupo de recursos, mas a configuração do grupo de recursos dedicado ocorre apenas no nível do serviço (por meio do campo cloud.networking).

  • cloud.computing: Especifica os tipos de instância disponíveis para scale-out em recursos públicos. Para mais informações, consulte Usar recursos públicos.

O exemplo a seguir mostra um arquivo de configuração JSON.

{
  "model_path": "http://examplebucket.oss-cn-shanghai.aliyuncs.com/models/lr.pmml",
  "name": "test_burstable_service",
  "processor": "pmml",
  "metadata": {
    "instance": 1,
    "cpu": 1,
    "resource": "eas-r-xxx",
    "resource_burstable": true
  },
   "cloud": {
        "computing": {
            "instance_type": "ecs.r7.2xlarge"
        },
        "networking": {
            "security_group_id": "sg-uf68iou5an8j7sxd****",
            "vswitch_id": "vsw-uf6nji7pzztuoe9i7****"
        }
    }
}

Ativar ou desativar o pool de recursos elásticos após a implantação do serviço

Uso do console

  1. Faça login no PAI console. Selecione uma região na parte superior da página. Em seguida, selecione o workspace desejado e clique em Elastic Algorithm Service (EAS).

  2. Clique em Update na coluna Actions do serviço implantado.

  3. Na página Update Service, vá até a seção Resource Information para ativar ou desativar o dimensionamento elástico.

    • Ativar o dimensionamento elástico

      Na seção Resource Information, ative a chave Elastic Resource Pool e configure a especificação do grupo de recursos público.

    • Desativar o dimensionamento elástico

      Na seção Resource Information, desative a chave Elastic Resource Pool.

  4. Clique em Update.

Uso de um cliente local

Utilize os comandos a seguir para ativar ou desativar rapidamente o dimensionamento automático de um serviço já implantado. O exemplo usa a versão Windows 64 bits:

Importante

Se você não configurou o parâmetro cloud.networking ao implantar o serviço em um grupo de recursos dedicado, as instâncias expandidas para o grupo de recursos público não terão suporte para conectividade direta de rede após a ativação do dimensionamento automático.

# Enable auto scaling for service resources.
eascmdwin64.exe modify <service_name> -Dmetadata.resource_burstable=true
# Disable auto scaling for service resources.
eascmdwin64.exe modify <service_name> -Dmetadata.resource_burstable=false

Substitua <service_name> pelo nome do seu serviço implantado.

Importante

A ativação ou desativação do dimensionamento automático afeta apenas as novas instâncias de serviço criadas. As instâncias existentes não são migradas automaticamente. Por exemplo, se duas instâncias estiverem no estado pendente quando o scale-out for concluído, ativar o dimensionamento automático posteriormente não moverá essas instâncias pendentes para o grupo de recursos público. Reinicie-as no console para que sejam reagendadas nos recursos públicos. Da mesma forma, se você desativar o dimensionamento automático para um serviço que já possui instâncias em execução em recursos públicos, essas instâncias não retornarão automaticamente ao grupo de recursos dedicado.

Referências

  • Ative o dimensionamento automático horizontal para permitir que o sistema dimensione automaticamente com base nas métricas configuradas. Para mais informações, consulte Dimensionamento automático horizontal.

  • Para dimensionar automaticamente o número de réplicas para um valor específico de acordo com uma programação, consulte Dimensionamento automático agendado.