Instâncias aceleradas por GPU oferecem desempenho computacional superior e processamento gráfico para cargas de trabalho exigentes.
Procedimento
Acesse a página de criação de instância.
Clique em na aba Custom Launch.
-
Configure o método de faturamento, a região, a rede, a zona de disponibilidade, o tipo de instância e a imagem.
A seção Parâmetros descreve cada parâmetro.
-
Revise a configuração da instância e defina opções como a duração de uso.
As configurações de duração de uso variam conforme o método de faturamento da instância:
Para instâncias de pagamento conforme o uso ou spot: defina um horário de liberação automática ou libere a instância manualmente após a criação. Também é possível configurar um cronograma de liberação automática. Consulte Liberar uma instância.
Para instâncias de assinatura: selecione uma duração e especifique se deseja ativar a renovação automática. Você também pode renovar manualmente após a criação. Consulte Renovar uma instância de assinatura.
Leia os termos de serviço e acordos e clique em Confirm Order.
Na página de pagamento, verifique o custo total e conclua o pagamento.
Parâmetros
Método de faturamento
O método de faturamento determina os preços e as regras do ciclo de vida dos recursos.
|
Método de faturamento |
Descrição |
Referências |
|
Subscription |
Você paga pelos recursos antes de usá-los. |
|
|
Pay-as-you-go |
Faturado por segundo. Compre e libere recursos sob demanda. Nota
Use um plano de economia ou uma instância reservada para otimizar custos. |
|
|
Spot Instance |
Oferece desconto em relação ao pagamento conforme o uso. O faturamento ocorre após o uso, mas a instância pode ser recuperada devido a alterações de preço ou estoque insuficiente. |
Região
Uma região corresponde à localização geográfica de um data center. Selecione uma região próxima aos seus usuários para reduzir a latência de rede. Não é possível alterar a região após a criação da instância. Para mais informações, consulte Regiões e zonas.
Rede e zona de disponibilidade
Recomendamos o uso de uma Virtual Private Cloud (VPC). As VPCs são ambientes de rede logicamente isolados que oferecem segurança aprimorada e suportam recursos como Endereços IP Elásticos (EIPs), interfaces de rede elásticas e IPv6.
Uma zona é uma área física dentro de uma região com energia e rede independentes. Instâncias na mesma zona apresentam menor latência de rede e proporcionam acesso mais rápido aos usuários.
|
Tipo de rede |
Descrição |
Tópicos relacionados |
|
VPC |
Uma VPC é um ambiente de rede isolado definido no Alibaba Cloud. Você tem controle total sobre sua VPC, incluindo a especificação de faixas de endereços IP e a configuração de tabelas de rotas e gateways. Se não for necessário personalizar as configurações da VPC durante a criação da instância, pule esta etapa. O sistema cria automaticamente uma VPC e um vSwitch padrão. Selecione uma VPC e um vSwitch existentes ou clique em Create VPC ou Create vSwitch para acessar o console VPC e criá-los. Após a criação, retorne à página de criação de instância ECS e clique em no ícone Nota
Se precisar atribuir um endereço IPv6 à instância, selecione uma VPC e um vSwitch com um bloco CIDR IPv6 ativado. |
Tipo de instância e imagem
O tipo de instância e a imagem definem os atributos básicos da instância: vCPUs, memória e sistema operacional.
Tipo de instância
Os tipos de instância disponíveis variam conforme fatores como a região. Acesse a página Tipos de instância disponíveis para compra para visualizar os tipos de instância que você pode criar.
Caso tenha requisitos específicos de configuração, como anexar múltiplas interfaces de rede elásticas, usar ESSDs ou discos locais, certifique-se de que o tipo de instância selecionado suporte esses recursos. Para mais detalhes sobre recursos, casos de uso e especificações das famílias de instâncias, consulte Famílias de instâncias.
Se definir Billing Method como Spot Instance, configure a duração de uso e o preço máximo.
-
Instance Usage Duration: especifica o período de proteção para uma Spot Instance. Após o término desse período, a instância pode ser liberada automaticamente devido a flutuações de preço de mercado ou estoque insuficiente do tipo de instância.
Duração
Descrição
1 Hour
A Spot Instance fica protegida por uma hora após a criação e não será liberada automaticamente durante esse período.
None
A Spot Instance não possui período de proteção após a criação, mas oferece melhor custo-benefício do que uma Spot Instance com período de proteção.
-
Highest Price per Instance:
Preço máximo
Descrição
Use Automatic Bid
Sempre utiliza o preço de mercado em tempo real para o tipo de instância. O preço de mercado não excede o preço da instância correspondente de pagamento conforme o uso. Esta opção impede que a Spot Instance seja liberada porque o preço de mercado excede seu lance, mas não evita a liberação devido a estoque insuficiente do tipo de instância.
Set Maximum Price
Insira um limite de preço específico. A Spot Instance é liberada automaticamente se o preço de mercado em tempo real exceder seu limite ou se o estoque ficar insuficiente.
Após configurar a instância, confirme os detalhes do tipo de instância selecionado em Selected.
Imagem
Uma imagem fornece os dados necessários para executar uma instância. O Alibaba Cloud oferece imagens das seguintes fontes.
|
Fonte da imagem |
Descrição |
|
Imagens base licenciadas fornecidas pelo Alibaba Cloud, incluindo Windows Server e distribuições Linux principais. |
|
|
Uma imagem criada ou importada por você, contendo configurações de sistema e aplicativos para reutilização. |
|
|
Uma imagem personalizada compartilhada por outra conta do Alibaba Cloud para criação de instâncias entre contas. |
|
|
Imagens pré-aprovadas do Alibaba Cloud Marketplace para implantação com um clique em de sites, aplicativos e outros ambientes. |
|
|
Uma imagem totalmente pública publicada por um usuário do Alibaba Cloud. É possível usar imagens da comunidade de outros usuários ou publicar as suas próprias. |
Durante a seleção da imagem, instale automaticamente um driver NVIDIA Tesla ou utilize uma imagem gratuita com driver NVIDIA GRID pré-instalado. Instalar ou carregar automaticamente um driver Tesla ao criar uma instância acelerada por GPU. Carregar automaticamente um driver GRID a partir de uma imagem da comunidade com driver pré-instalado.
Armazenamento
As instâncias obtêm armazenamento adicionando discos de sistema, discos de dados, discos efêmeros elásticos e sistemas de arquivos Apsara File Storage NAS (NAS). O ECS oferece discos em nuvem e discos locais para atender aos requisitos de diferentes cenários.
-
Discos em nuvem podem ser usados como discos de sistema e discos de dados. Os tipos incluem ESSDs, SSDs padrão e ultra discos. Para mais informações, consulte Visão geral de discos.
NotaUm disco em nuvem criado com uma instância possui o mesmo método de faturamento da instância.
-
Discos locais podem ser usados apenas como discos de dados. Se o tipo de instância estiver equipado com discos locais, como famílias de instâncias de SSD local ou big data, as informações do disco local serão exibidas na página. Para mais informações, consulte Discos locais.
NotaNão é possível anexar discos locais manualmente a uma instância.
Disco de sistema
O disco de sistema serve para instalar o sistema operacional. A capacidade padrão é de 40 GiB, mas a capacidade mínima configurável depende do tipo de imagem, conforme mostrado na tabela a seguir.
|
Imagem |
Faixa de capacidade (GiB) |
|
Linux (exceto FreeBSD e Red Hat) |
[max{20, tamanho da imagem}, 2048] |
|
FreeBSD |
[max{30, tamanho da imagem}, 2048] |
|
Red Hat |
[max{40, tamanho da imagem}, 2048] |
|
Windows |
[max{40, tamanho da imagem}, 2048] |
(Opcional) Disco de dados
Discos de dados armazenam dados de aplicativos. Ao selecionar um disco de dados, também é possível criptografar o disco em nuvem para atender a requisitos de segurança de dados ou conformidade regulatória. Para mais informações sobre criptografia de dados, consulte Criptografia.
A quantidade de discos de dados que podem ser anexados a uma única instância é limitada. Para mais informações, consulte Limites de armazenamento em bloco.
(Opcional) Snapshots
Um snapshot é um backup dos dados de um disco em nuvem em um ponto específico no tempo. Criar um disco em nuvem a partir de um snapshot é uma maneira eficiente de importar dados. Ative backups automáticos para discos em nuvem durante a criação da instância para proteger contra perda de dados por exclusão acidental.
Selecione uma política de snapshot automático existente ou clique em Create Automatic Snapshot Policy para acessar a página de Snapshot e criar uma. Para mais informações, consulte Criar uma política de snapshot automático. Após criar a política, retorne à página de criação de instância ECS e clique em no ícone
para atualizar a lista de políticas de snapshot automático.
Snapshots geram taxas. Para mais informações, consulte Faturamento de snapshots.
(Opcional) NAS
Se precisar compartilhar uma grande quantidade de dados entre várias instâncias, recomendamos o uso de um sistema de arquivos NAS para reduzir custos de cópia e sincronização de dados.
Selecione um sistema de arquivos NAS existente ou clique em Create File System para acessar o console NAS e criar um. Para mais informações, consulte Criar um sistema de arquivos NAS de uso geral no console. Após criar o sistema de arquivos, retorne à página de criação de instância ECS e clique em no ícone
para atualizar a lista de sistemas de arquivos NAS. Para obter instruções sobre como montar um sistema de arquivos NAS, consulte Montar um sistema de arquivos NAS ao comprar uma instância ECS.
Rede e grupo de segurança
Configure o acesso à internet pública, a comunicação entre recursos e a segurança de rede.
(Condicionalmente obrigatório) Endereço IP público
Uma instância precisa de um endereço IP público para se comunicar com a internet. Atribua automaticamente um endereço IP público fixo ao criar a instância ou configure um posteriormente usando um EIP ou gateway NAT. EIPs e gateways NAT devem ser comprados separadamente. Para mais informações, consulte O que é um Elastic IP Address? e O que é um NAT Gateway?.
Selecione Assign Public IPv4 Address e defina Bandwidth Billing Method e Bandwidth ou Maximum Bandwidth.
Para regras detalhadas sobre o faturamento de largura de banda pública, consulte Faturamento de largura de banda pública.
|
Método de faturamento |
Descrição |
|
Pay-by-bandwidth |
As cobranças baseiam-se em uma largura de banda fixa especificada por você. A largura de banda de saída real não excede este valor.
|
|
Pay-by-traffic |
As cobranças baseiam-se nos dados realmente transferidos. Para evitar altas taxas de tráfego, defina uma largura de banda de saída de pico.
(Opcional): Selecione Upgrade to CDT for Data Transfer Billing. O Cloud Data Transfer (CDT) oferece uma solução eficiente e econômica para gerenciar custos de largura de banda pública com faturamento flexível, cotas gratuitas de transferência de dados, preços escalonados e faturamento unificado entre vários produtos. Ele oferece descontos em comparação ao método padrão de pagamento conforme o uso. Para mais informações, consulte O que é Cloud Data Transfer (CDT)? Importante
|
Grupo de segurança
Um grupo de segurança atua como um firewall virtual que controla o tráfego de entrada e saída das instâncias dentro do grupo. Para mais informações, consulte Visão geral de grupos de segurança.
Se não existir nenhum grupo de segurança na VPC selecionada, o sistema cria um grupo de segurança padrão. Por padrão, o grupo de segurança permite tráfego de entrada nas portas 22 e 3389, além do protocolo ICMP. Também é possível permitir tráfego nas portas 80 e 443 conforme necessário, ou modifique as regras do grupo de segurança após a criação.
Você também pode selecionar um grupo de segurança existente ou criar um novo clicando em Create Security Group. Ao criar um novo grupo de segurança, configure o Security Group Name, Security Group Type e Open IPv4 Ports/Protocols.
Para uma descrição detalhada das configurações do grupo de segurança, consulte Criar um grupo de segurança.
(Opcional) Interface de rede elástica
Uma interface de rede elástica pode ser uma ENI primária ou secundária. A ENI primária não pode ser desvinculada da instância e é criada e liberada junto com ela. As ENIs secundárias podem ser vinculadas e desvinculadas livremente das instâncias, permitindo alternar o tráfego de rede entre elas. Para criar uma ENI secundária junto com a instância, clique em no ícone
e selecione o vSwitch para a ENI secundária.
É possível adicionar apenas uma ENI secundária durante a criação da instância. Crie e vincule ENIs secundárias adicionais após a criação da instância. Para verificar a quantidade de ENIs suportadas por cada tipo de instância, consulte Famílias de instâncias.
(Opcional) Configurar IPv6
O IPv6 fornece um vasto número de endereços, resolvendo o esgotamento de endereços IP e removendo barreiras de conexão para diversos dispositivos.
Selecione Assign IPv6 Address Free of Charge. Após a atribuição de um endereço IPv6, faça logon na instância e configure o endereço IPv6 no sistema operacional para utilizá-lo. Para obter instruções, consulte Comunicação IPv6.
Configurações de gerenciamento
Configure credenciais de logon para acesso remoto e tags para gerenciamento de recursos.
Credencial de logon
As Logon Credential servem para fazer logon seguro em uma instância. Para mais informações sobre métodos de conexão de instância, consulte Conectar-se a uma instância ECS.
|
Método |
Descrição |
|
Key Pair Nota
Apenas instâncias Linux suportam autenticação por par de chaves. |
Selecione um nome de usuário para logon e um par de chaves existente, ou clique em Create Key Pair para criar um. Após criar o par de chaves, retorne à página de criação de instância ECS e clique em no ícone Defina o nome de usuário como root ou ecs-user. Aviso
O usuário root possui os privilégios mais altos do sistema operacional. Usar root como nome de usuário pode representar riscos de segurança. Recomendamos o uso do usuário padrão ecs-user. |
|
Use Predefined Password Nota
Este método de autenticação é suportado apenas para Custom Image e Shared Image. |
Utilize a senha predefinida da imagem selecionada para logon. Certifique-se de que uma senha esteja definida na imagem selecionada. |
|
Password |
Insira e confirme uma senha. O nome de usuário para logon baseado em senha é determinado da seguinte forma:
|
|
Set Later |
Após a criação da instância, vincule um par de chaves ou redefina a senha da instância. Para obter instruções, consulte Vincular um par de chaves SSH a uma instância e Redefinir a senha de logon de uma instância. |
Tag
Uma Tag é um par chave-valor usado para identificar as instâncias criadas, discos em nuvem e ENIs primárias. Tags facilitam a busca e o gerenciamento de recursos. Selecione uma tag existente ou insira uma chave e um valor de tag para criar uma. Para mais informações sobre tags, consulte Tags.
(Opcional) Opções avançadas
Personalize o hostname da instância, metadados e dados de usuário.
|
Parâmetro |
Descrição |
|
Instance Name, Description, Host Name e Sequential Suffix |
Defina nomes e hostnames sequenciais ao criar múltiplas instâncias para identificar lotes. Configurar em lote nomes ou hostnames sequenciais de instâncias. |
|
Instance RAM Role |
Anexe uma Instance RAM Role para conceder à instância tokens STS temporários para acessar APIs e recursos de serviços em nuvem, aumentando a segurança. Selecione uma Instance RAM Role existente ou clique em Create Instance RAM Role para criar uma no console RAM. Após a criação, clique em no ícone |
|
Metadata access mode |
Os metadados da instância fornecem informações sobre a instância no sistema Alibaba Cloud. Consulte-os de dentro da instância para configurá-la ou gerenciá-la. Metadados da instância. |
|
User data |
Forneça um script de inicialização para automatizar a configuração da instância ou passe dados simples para a instância. Personalizar configurações de bootstrap da instância. Se não selecionou a opção Images na seção Image e estiver familiarizado com scripts de instalação automática de drivers, insira um script de instalação automática na seção User data para instalar o driver NVIDIA Tesla. Para mais informações, consulte Instalar um driver usando um script de instalação automática. Nota
Insira seus dados de usuário preparados na caixa de entrada. Se os dados de usuário estiverem codificados em Base64, selecione Enter Based64-encoded Content. |
|
Resource Group |
Organize recursos entre regiões e serviços por unidade de negócio, com controle de permissão no nível do grupo. Grupos de recursos. Selecione um grupo de recursos existente ou clique em Create Resource Group para criar um. Após a criação, clique em no ícone |
|
Deployment Sets |
Distribua instâncias entre servidores físicos para alta disponibilidade e recuperação de desastres. Selecione um conjunto de implantação existente ou clique em Manage Deployment Sets para criar um. Após a criação, clique em no ícone |
|
Dedicated Hosts |
Um Dedicated Host (DDH) é um servidor físico de locatário único para necessidades rigorosas de segurança, conformidade e Bring Your Own License (BYOL). Selecione um DDH existente ou clique em Create Dedicated Host para criar um. Após a criação, clique em no ícone |
|
Private Pool Type |
Garantias elásticas e reservas de capacidade geram pools privados que garantem a disponibilidade de recursos para tipos específicos de instância. Visão geral de Garantia e Reserva de Recursos. Nota
A garantia elástica e a reserva de capacidade garantem certeza de fornecimento de recursos apenas para instâncias de pagamento conforme o uso.
|
Próximos passos
-
Conectar-se à instância
Conecte-se usando Workbench, VNC ou ferramentas de terceiros. Escolher um método de conexão remota ECS.
-
Instalar um driver
Se nenhum driver foi instalado automaticamente durante a criação da instância, instale o driver Tesla ou GRID correto para o seu tipo de instância. Diretrizes de instalação para drivers Tesla e GRID.
Documentos relacionados
Criar instâncias programaticamente: RunInstances ou CreateInstance.
Ativar, hibernar, reiniciar, liberar ou parar uma instância: Gerenciar uma instância acelerada por GPU.
Implantar um ambiente NGC para acesso imediato a frameworks de deep learning otimizados. Implantar um ambiente NGC para construir um ambiente de desenvolvimento de deep learning.
Solucionar problemas de GPU: FAQ sobre instâncias aceleradas por GPU.