Crie um cluster gerenciado do E-HPC para executar cargas de trabalho de HPC. O E-HPC provisiona e mantém o nó de gerenciamento; você configura apenas os nós de computação e as filas de jobs.
A criação de um cluster provisiona recursos faturáveis, como instâncias ECS. Visão geral do faturamento.
Arquitetura do cluster
Um cluster gerenciado possui três componentes:
Nós de computação: instâncias ECS organizadas em filas escaláveis. A quantidade de nós se ajusta conforme a demanda da carga de trabalho.
Nó de logon: uma única instância ECS com o addon Login e um EIP para acesso remoto.
Sistema de arquivos compartilhado: um sistema de arquivos NAS ou CPFS compartilhado entre todos os nós para dados de jobs e aplicativos.
Não utilize o console do ECS para gerenciar nós em um cluster E-HPC, a menos que seja estritamente necessário. Utilize o console do E-HPC.
Pré-requisitos
Verifique os seguintes requisitos:
Uma função vinculada ao serviço E-HPC (criada automaticamente no primeiro acesso ao console do E-HPC).
Uma VPC e um vSwitch. Criar e gerenciar uma VPC. Criar um vSwitch.
NAS ativado, com sistema de arquivos e destino de montagem criados. Criar um sistema de arquivos. Criar um destino de montagem.
Procedimento
Etapa 1: Abrir a página Create Cluster
Acesse a página Create Cluster no console do E-HPC.
Etapa 2: Configurar o cluster
Na etapa Cluster Configuration, configure as definições de rede, tipo de cluster e agendador.
Configurações básicas
|
Parâmetro |
Descrição |
|
Region |
Região onde o cluster será criado. |
|
Network and Availability Zone |
VPC e vSwitch destinados ao cluster. Os nós utilizam endereços IP do vSwitch. Verifique se o vSwitch possui mais endereços IP disponíveis do que o número total de nós do cluster. |
|
Security group |
Controla o tráfego dos nós do cluster. Opções: Automatically create a normal security group, Automatically create enterprise security groups ou Select Existing Security Group. As regras de comunicação entre nós são criadas automaticamente. Grupos de segurança básicos suportam até 2.000 nós; para clusters maiores, utilize grupos avançados. Grupos de segurança básicos e avançados. |
Tipo de cluster
O E-HPC cria e mantém o nó de gerenciamento. Você gerencia apenas os nós de computação.
|
Parâmetro |
Descrição |
|
Series |
Selecione Managed Edition. |
|
Deployment Mode |
Selecione Public cloud cluster. |
|
Cluster Type |
Selecione Slurm (única opção suportada). |
Opções personalizadas
|
Parâmetro |
Descrição |
|
Scheduler |
Software de agendamento a ser implantado. Apenas o Slurm 22 é suportado. |
|
Domain Account |
Serviço de conta de domínio para o cluster. Apenas o NIS (Network Information Service) é suportado em clusters gerenciados. |
|
Domain name resolution |
Utilize o valor padrão. |
|
Maximum number of cluster nodes |
Quantidade máxima de nós que o cluster pode conter. Funciona em conjunto com Maximum number of cores in the cluster para controlar o tamanho do cluster. |
|
Maximum number of cores in the cluster |
Número máximo de vCPUs disponíveis para os nós de computação. Atua juntamente com Maximum number of cluster nodes para definir o dimensionamento do cluster. |
|
Cluster Deletion Protection |
Impede a exclusão acidental do cluster. Quando ativada, o cluster não pode ser liberado até que você desative esta configuração. |
Grupo de recursos
Atribua o cluster a um grupo de recursos. Padrão: grupo de recursos padrão. Grupos de recursos.
Etapa 3: Configurar nós de computação e filas
Na etapa Compute Node and Queue, defina as filas e os nós de computação.
Os nós são organizados em filas. Especifique uma fila de destino ao enviar jobs. Cada cluster possui uma fila padrão comp. Clique em Add more queues para adicionar outras.
Configure cada fila:
Configurações básicas
|
Parâmetro |
Descrição |
|
Automatic queue scaling |
Ative o dimensionamento automático. Selecione Auto Grow e/ou Auto Shrink para adicionar ou remover nós de computação conforme a carga de trabalho. |
|
Queue Compute Nodes |
Define as quantidades inicial, máxima e mínima de nós. Sem dimensionamento automático: defina apenas a quantidade inicial. Com dimensionamento automático: configure os limites mínimo e máximo. |
Definir Minimal Nodes com um valor diferente de zero mantém essa quantidade de nós durante a redução de escala, mesmo quando ociosos. Configure este valor com atenção para evitar custos desnecessários.
Configuração dos nós da fila
Obrigatório quando o dimensionamento automático está ativado ou a contagem inicial de nós é superior a 0.
|
Parâmetro |
Descrição |
|
Inter-node interconnection |
Modo de comunicação entre os nós de computação. Opções: VPC Network (padrão) ou eRDMA Network (para instâncias compatíveis com ERIs). Visão geral do eRDMA. Configurar eRDMA em uma instância de nível empresarial. |
|
Use Preset Node Pool |
Reutiliza recursos pré-alocados durante o aumento de escala. Utilizar pools de nós reservados em clusters. |
|
Virtual Switch |
vSwitch destinado aos nós de computação. O sistema atribui endereços IP a partir do bloco CIDR do vSwitch. |
|
Instance type Group |
Clique em Add Instance para selecionar os tipos de instância. Sem dimensionamento automático: apenas um tipo de instância. Com dimensionamento automático: múltiplos tipos de instância. |
Especifique múltiplos vSwitches e tipos de instância como alternativas para casos de falta de estoque. O sistema tenta criar os nós seguindo a ordem dos tipos de instância e zonas especificados. O primeiro vSwitch determina a zona inicial.
Dimensionamento automático
Disponível quando o dimensionamento automático está ativado.
|
Parâmetro |
Descrição |
|
Scaling Policy |
Apenas a Supply Priority Strategy é suportada. Os nós são criados nas zonas especificadas, seguindo a ordem dos vSwitches configurados. |
|
Maximum number of single expansion nodes |
Quantidade de nós a adicionar ou remover por ciclo de dimensionamento. Padrão: |
|
Prefix of Hostnames |
Prefixo de hostname que distingue os nós em diferentes filas. |
|
Hostname Suffix |
Sufixo de hostname que distingue os nós em diferentes filas. |
|
Instance RAM role |
Função RAM que concede aos nós acesso aos serviços da Alibaba Cloud. Padrão: |
Etapa 4: Configurar armazenamento de arquivos compartilhado
Na etapa Shared File Storage, configure o sistema de arquivos compartilhado entre os nós do cluster.
Por padrão, o sistema de arquivos é montado em /home e /opt no nó de gerenciamento. Clique em Add more storage para montar diretórios adicionais.
Não é possível montar diretórios de sistemas de arquivos diferentes em /home e /opt.
|
Parâmetro |
Descrição |
|
Type |
Tipo de sistema de arquivos: General-purpose NAS, Extreme NAS ou Parallel file CPFS. |
|
File System |
ID e ponto de montagem do sistema de arquivos. Certifique-se de que o sistema de arquivos possui pontos de montagem suficientes. |
|
File System Directory |
Diretório do sistema de arquivos a ser montado. |
|
Mount Options |
Configurações do protocolo de montagem. |
Etapa 5: Configurar software e addons
Na etapa Software and Service Component, instale softwares e configure addons.
Clique em Add software. Na caixa de diálogo, selecione os aplicativos HPC a serem instalados.
Clique em Add Service Component. Na caixa de diálogo, selecione e configure um addon.
Apenas o addon Login é suportado, ativado por padrão para acesso à internet.
O addon Login possui os seguintes parâmetros:
|
Categoria |
Parâmetro |
Descrição |
|
Parâmetros personalizados |
SSH |
Número da porta, protocolo e blocos CIDR permitidos para conexões SSH. |
|
Parâmetros personalizados |
VNC |
Número da porta, protocolo e blocos CIDR permitidos para conexões VNC. |
|
Parâmetros personalizados |
Web Portal |
Número da porta, protocolo e blocos CIDR permitidos para conexões de cliente. |
|
Recursos de implantação do addon |
EIP |
EIP vinculado à instância ECS do addon Login para acesso à internet. Selecione um EIP existente ou crie um novo. |
|
Recursos de implantação do addon |
ECS Instance |
Tipo de instância para a instância ECS que executa o addon Login. |
Etapa 6: Confirmar e criar
Na etapa Confirm configuration, revise as configurações, defina um nome para o cluster e as credenciais.
|
Parâmetro |
Descrição |
|
Cluster Name |
Nome de exibição na página Clusters. |
|
Login Credentials |
Apenas Custom Password é suportado. |
|
Set Password e Repeat Password |
Senha do usuário root para todos os nós do cluster. |
Aceite o acordo de serviço, confirme as taxas e clique em Create Cluster.
Próximos passos
Após a criação do cluster, crie um usuário de cluster para enviar jobs. Gerenciar usuários. Visão geral de jobs.