Elastic GPU Service

Instâncias de computação elástica com aceleradores de computação GPU adequados para cenários (como
inteligência artificial (especificamente aprendizado profundo e aprendizado de máquina), computação de alto desempenho e
processamento gráfico profissional)

Suporte para computação heterogênea em todos os cenários

O Elastic GPU Service fornece um sistema de serviço completo que combina software e hardware para ajudá-lo a alocar recursos de forma flexível, dimensionar elasticamente seu sistema, melhorar o poder de computação e reduzir o custo de seus negócios relacionados à IA. Aplica-se a cenários (como aprendizagem profunda, codificação e decodificação de vídeo, processamento de vídeo, computação científica, visualização gráfica e jogos em nuvem).

O Elastic GPU Service fornece recursos de computação acelerados por GPU e recursos de computação de GPU escaláveis prontos para uso. As GPUs têm vantagens exclusivas na execução de computação matemática e geométrica, especialmente computação paralela e de ponto flutuante. GPUs fornecem 100 vezes o poder computacional dos CPU.

Capacidades computacionais variadas

Possui um grande número de unidades lógicas aritméticas (ALUs) que podem ser usadas para computação paralela em larga escala. O Elastic GPU Service usa os chips de aceleração de GPU mais recentes e fornece várias placas aceleradoras (como FPGA, GPU e ASIC) para fins comerciais (como IA, gráficos, transcodificação, e encriptação).

Facilidade de uso

Recursos da GPU são implantados globalmente em diferentes localizações geográficas. Unidades de controle lógico simples permitem dimensionar seu sistema com base nos requisitos do seu negócio. O Elastic GPU Service também fornece ferramentas auxiliares (como AIACC, FastGPU e cGPU).

Alto desempenho de rede

Usa a arquitetura SHENLONG para melhorar o desempenho do servidor e reduzir a latência de E/S. A GPU suporta até 24 milhões de pps, uma largura de banda de até 64 Gbit/s sobre VPCs. É adequado para cenários de alto rendimento onde vários threads são executados em paralelo para processar tarefas de computação.

Software de GPU para melhorar a eficiência computacional

A Alibaba Cloud fornece ferramentas auxiliares

AIACC-Training

O Alibaba Cloud AIACC-Training é um acelerador de IA otimizado para ambientes da Alibaba Cloud. Ele pode melhorar significativamente a eficiência do treinamento distribuído por IA e a utilização da banda larga. O AIACC-Training estabeleceu dois recordes mundiais: velocidade de treinamento mais rápida na competição DAWNBench ImageNet (realizada pela Stanford University) Menor custo de treinamento na competição DAWNBench ImageNet (realizada pela Stanford University)

Saiba mais >

Características

  • Compatível com os principais frameworks

    Estruturas de treinamento distribuídas: TensorFlow, PyTorch, MXNet e Caffe

  • 50%-300% Melhorias de desempenho

    Modelos de rede intensivos em banda

  • Comunicação de alto desempenho para um ou mais servidores Multi-GPU

    Suporta compressão gradiente FP16 e compressão de precisão mista

  • Extensões API para MXNet

    Suporta paralelismo de dados e paralelismo de modelo do tipo InsightFace

  • Otimização profunda para redes RDMA

    Comunicação por links híbridos (RDMA e VPC)

AIACC-Inference

O Alibaba Cloud AIACC-Inference é um acelerador de IA otimizado para ambientes da Alibaba Cloud. Pode melhorar significativamente a utilização da GPU e desempenho de inferências. A AIACC-Inference estabeleceu dois recordes mundiais:
Menor latência de inferência na competição DAWNBench ImageNet (realizada pela Stanford University)
Menor custo de inferência na competição DAWNBench ImageNet (realizada pela Stanford University)

Saiba mais >

Características

  • Suporta múltiplas estruturas

    Tensorflow, Pytorch, MXNet e outras estruturas de aprendizado profundo podem exportar modelos no formato Open Neural Network Exchange (ONNX) para melhorar o desempenho de inferências

  • 30%-400% Melhorias de desempenho

    Modelos de rede intensivos em computação

  • Suporta múltiplas precisões do modelo

    Otimização do modelo em FP32 e FP16

Ferramento de implantação de cluster da GPU

O Alibaba Cloud FastGPU é um conjunto de ferramentas de implantação rápida para clusters de GPU para ajudar a implantar recursos de computação de GPU na nuvem com apenas alguns cliques. O FastGPU é simples de configurar e pode ser usado em qualquer lugar com facilidade. O FastGPU oferece uma solução econômica, que economiza tempo e fácil de usar para a implantação rápida de clusters de GPU.

Saiba mais >

Características

  • Implantação rápida

    Operações API para implantação rápida de scripts off-line de treinamento e inferência em clusters da GPU

  • Gerenciamento fácil

    Fornece uma ferramenta de linha de comando para gerenciar o status e o ciclo de vida dos clusters da GPU

  • Eficiente e economiza tempo

    Você não precisa executar operações de implantação para computação, armazenamento e rede na camada IAAS da Alibaba Cloud. O ambiente apropriado é obtido automaticamente quando você obtém recursos do cluster.

Software de compartilhamento de GPU para contêineres

Ele permite que vários contêineres usem uma única GPU dividindo e atribuindo recursos da GPU a vários contêineres isolados. A cGPU pode executar vários contêineres em uma única GPU e isolar os aplicativos da GPU entre os contêineres. Dessa forma, a utilização dos recursos do hardware da GPU é melhorada.

Saiba mais >

Características

  • Divisão da GPU

    Divide recursos da GPU para melhorar a utilização da GPU

  • Compartilhamento da GPU

    Economia através do compartilhamento GPU em vários aplicativos de IA

  • Flexibilidade

    Divide com flexibilidade o poder computacional e a memória da GPU para atender aos requisitos do aplicativo

Elastic GPU Service VS servidores acelerados por GPU autogerenciados

Item Elastic GPU Service Self-Managed GPU-Accelerated Server
Flexibilidade
· Permite que você crie uma ou mais instâncias aceleradas por GPU com facilidade
· Mudanças flexíveis na configuração da instância – quando a instância não atende mais às suas necessidades, basta uma reinicialização simples para alternar entre várias especificações dentro da mesma família.
· Fornece bandas ajustáveis
· Requer um período de assinatura estendido
· Tem configurações que não podem ser alteradas
· Requer compra única de largura de banda de saída que não pode ser ajustada
Facilidade de uso
· Fornece um console baseado na web para gerenciamento on-line
· Tem um sistema operacional mainstream embutido (como um sistema operacional Windows genuíno ativado) e permite que o sistema operacional seja substituído on-line
· Permite que você compre e instale drivers de GPU ao comprar a instância
· Não fornece ferramentas de gerenciamento online e requer gerenciamento e manutenção manuais
· Você precisa trazer o seu próprio sistema operacional, instalar e substituí-lo você mesmo
・Você deve preparar e instalar manualmente os sistemas operacionais
Recuperação de Desastres e Backup
· Armazena três cópias de cada pedaço de dados. Quando uma cópia está corrompida, os dados podem ser restaurados rapidamente
· As falhas do hardware podem ser recuperadas rapidamente e automaticamente
· Você deve criar manualmente um ambiente de recuperação de desastres e usar dispositivos de armazenamento tradicionais caros
· Você deve corrigir manualmente os dados corrompidos
Custo
· Suporta os métodos de assinatura e pagamento conforme o uso. Você pode selecionar um método de faturamento apropriado com base nas necessidades do seu negócio
· Permite que você compre recursos sob demanda sem fazer um grande investimento inicial
· Requer que você compre recursos pagando antecipadamente para atender aos requisitos de configuração dos horários de pico
· Requer um grande investimento inicial e resulta em um desperdício de recursos

Cenários

Solução líder da indústria e alto desempenho

O Alibaba Cloud Elastic GPU Service fornece soluções líderes do setor que podem oferecer alto desempenho, escalabilidade e confiabilidade de nível empresarial em simulação e análise de engenharia. Com a ajuda de grande tamanho de memória e alto desempenho da GPU, você pode aproveitar o poder de computação para executar simulações complexas e resolver problemas desafiadores.

Benefícios

  • Solução otimizada

    Aproveita a modelagem CFD para reduzir significativamente o tempo de resolução

  • Projeto Eletrônico Acelerado de Eletromagnetismo Computacional

    Ajude a projetar produtos e componentes eletrônicos de alto desempenho simulando um desempenho eletromagnético e prevendo radiação eletromagnética, interferência e transmissão

  • Simulação de engenharia

    Aplicativos virtualizados na nuvem que aumentam a produtividade e economizam custos de TI

Processamento de vídeo HD para melhor exibição

As tarefas de processamento de vídeo geralmente encontram problemas (como grandes volumes de dados e longos tempos de processamento). A GPU pode computar tarefas paralelamente e pode ser usada para otimizar o processamento de vídeo. A GPU é usada principalmente em campos como transcodificação de vídeo de alta definição em larga escala, transmissão ao vivo 4K e 8K, videoconferência multiusuário e reparo de fontes de vídeo.

Benefícios

  • Alto desempenho

    Otimizações para melhorar o desempenho computacional

  • Potência computacional superior

    Suporta processamento rápido de dados multi-frame e poder computacional para processar um grande número de tarefas computacionais

Computação de Alto Desempenho

A GPU desempenha um papel essencial na computação científica (como previsão meteorológica, exploração de hidrocarbonetos e pesquisa de dinâmica molecular), que requer computação paralela em larga escala. Em combinação com a computação elástica, a GPU fornece o poder computacional necessário para operações de ponto flutuante em larga escala. Esse poder computacional está disponível online e offline.

Benefícios

  • Dimensionamento automático

    Integra com o Auto Scaling e o SLB para implementar o dimensionamento automático

  • Potência computacional superior

    Fornece as mais recentes GPUs e métodos de implantação rápida para atender aos grandes requisitos de computação científica

Histórias de sucesso

O maior fator decisivo foi a precisão do reconhecimento: a Vision AI Platform reconheceu placas para processamento de mosaico com mais de 90% de precisão desde o início do processo de validação.

Após ajuste detalhado adicional, o sistema pôde executar automaticamente o reconhecimento e o processamento do mosaico com uma precisão de mais de 95% no momento da introdução.

– Sr. Chiaki Uchiyama, Líder de Seção, Seção Frima Marketing, Divisão Frima, IDOM Co.

IDOM Inc. (Chiyoda-ku, Tóquio) opera um negócio de venda e compra de carros usados que lida com um dos dados de distribuição de veículos em maior escala no Japão, abrindo recentemente lojas superdimensionadas com manutenção aprimorada, chapa metálica, e serviços pós-venda.

A plataforma IDOM permite que os usuários carreguem livremente fotos de veículos que planejam vender, mas enfrenta problemas de limitação de autoatendimento e aumento do horário de trabalho devido a verificações manuais e retrabalhos. A Alibaba Cloud pode ajudar a fornecer tecnologia de reconhecimento de imagem altamente precisa e suporte presencial.

O Ms-meta.HK alavancou uma variedade de serviços pela Alibaba Cloud em sua implementação de solução. Esses serviços (juntamente com os especialistas técnicos locais da Alibaba Cloud e a equipe de suporte dedicada) permitiram que o Ms-meta.HK lançasse facilmente sua oferta de Metaverso ao público.

Ms-meta.HK é um projeto de Metaverso descentralizado e orientado pela comunidade com sede em Hong Kong. Ms-meta.HK utiliza ativamente as tecnologias de renderização e distribuição de tráfego da Alibaba Cloud em seu Metaverso. Colaborar com a Alibaba Cloud permite que Ms-meta.HK otimize as cenas virtuais em seu Metaverso e reduza o tempo de carregamento para fornecer aos clientes uma melhor experiência do usuário. Além disso, a empresa pode proteger seus servidores expostos publicamente graças à robusta oferta de segurança da Alibaba Cloud. O Ms-meta.HK espera otimizar ainda mais seus serviços de infraestrutura de Metaverso com a ajuda da Alibaba Cloud.

Como parte de seu negócio principal, a ADVANCE utiliza várias soluções nativas de armazenamento e gerenciamento de dados na Alibaba Cloud para gerenciar seus processos de data warehouse e análise de dados para seu algoritmo de IA e aprendizagem de máquina. Por exemplo, o ADVANCE usa o ApsaraDB for Redis para armazenamento em cache na memória e acesso de alta velocidade, o ApsaraDB for MongoDB para armazenamento de dados flexível e semiestruturado, o DataWorks para agregação de dados, processamento, e governança entre várias fontes de dados e o Realtime Compute for Apache Flink para processamento de big data em tempo real.

O Advance Intelligence Group (ADVANCE) é uma empresa de tecnologia orientada à lA na Ásia-Pacífico e um dos principais players do mercado do Sudeste Asiático (SEA), especialmente na Indonésia.

A ADVANCE está empenhada em fornecer aos seus clientes serviços aprimorados de IA. A Alibaba Cloud continuará a apoiar a ADVANCE para alcançar o sucesso através de serviços inovadores. A combinação de IA e computação em nuvem proporcionará muito mais valor aos clientes com maior eficiência, produtividade e segurança digital.

phone Fale Conosco
Oi, eu sou o assistente de IA da Alibaba Cloud!
Posso ajudar com perguntas e soluções.