Visão geral
O desenvolvimento de tecnologia de machine learning para serviços de IA depende de dados, algoritmos e poder de computação. A solução de aceleração de IA do Alibaba Cloud utiliza conjuntos de dados líderes e aceleradores de GPU para orquestrar aplicações intensivas em dados, otimizar a utilização de instâncias GPU e acelerar tarefas de treinamento e inferência de modelos de IA. Você também pode usar a plataforma de treinamento de IA cloud-native personalizável do Alibaba Cloud para adaptar às necessidades do seu negócio e melhorar a eficiência da infraestrutura de IA e das operações diárias.
Baixar whitepaperDestaques da solução
-
Aceleração atômica com custo-benefício
Acelere o treinamento e a inferência de modelos de IA com o acelerador de GPU mais rápido, AIACC, de acordo com o Stanford DAWN Deep Learning Benchmark, para acelerar modelos de treinamento de IA em 70% e a inferência em 2-3 vezes e reduzir custos
-
Uso altamente eficiente de GPU
Melhore a taxa de utilização de todas as GPUs no cluster com o agendamento de cluster de GPU que compartilha os recursos da mesma GPU e elimine a interferência entre aplicativos com o mecanismo de isolamento de GPU
-
Acelerador de conjunto de dados reconhecido pela CNCF
Resolva alta latência de acesso, acesso paralelo complexo de múltiplas fontes de dados e isolamento fraco de dados durante o treinamento de IA com o Fluid, o orquestrador e acelerador de conjuntos de dados distribuídos para aplicações intensivas em dados
-
Plataforma de treinamento de IA personalizável
Crie e personalize sua plataforma de treinamento de IA cloud-native com um console para desenvolvimento e O&M usando o Alibaba Cloud-Native AI Suite para melhorar a eficiência da engenharia de IA em todas as etapas do deep learning
Como funciona
A solução de aceleração de IA do Alibaba Cloud inclui a camada Cloud-Native AI Suite, a camada de agendamento de tarefas de IA, a camada de aceleração de dados de IA, a camada do mecanismo de aceleração de computação de IA, a camada de agendamento de recursos e a camada de recursos de computação. Cada camada oferece soluções de aceleração específicas com base nas características das aplicações de IA em diversos cenários.
Cloud-Native AI Suite: Simplifique operações com serviços e componentes subjacentes, monitore a utilização de recursos GPU e colete e analise logs de tarefas de IA. Você pode usar linhas de comando para enviar tarefas de IA e verificar o cronograma de treinamento de modelos.
Agendamento de tarefas de IA: Agende tarefas de IA para acelerar o treinamento de modelos, aumentar a utilização de GPU e reduzir custos.
AIACC: Utilize frameworks de deep learning como TensorFlow, PyTorch, MXNet e Caffe para categorizar imagens e realizar reconhecimento de imagem, previsão de CTR (taxa de cliques), processamento de linguagem natural, reconhecimento de fala, reconhecimento facial, entre outros.
Aceleração de dados: Adote a arquitetura com armazenamento e computação separados, com dados armazenados em dispositivos diferentes dos locais e treinamento de modelos executado no Alibaba Cloud. Os dados são armazenados em arquivos pequenos e pré-carregados antes do treinamento de modelos para melhorar a eficiência de transmissão e treinamento.
Agendamento de recursos: Aumente a utilização de GPU e reduza custos compartilhando recursos GPU entre múltiplas tarefas de IA e executando tarefas individuais em várias GPUs para treinamento distribuído de modelos.
Recursos de computação — GPU: Gerencie e agende memória GPU e poder de computação como contêineres com cGPU para acelerar o treinamento e a inferência de IA.
Alta utilização de GPU com cGPU
Maximize a eficiência da utilização de GPU e reduza custos gerenciando e agendando memória GPU e poder de computação como contêineres
Saiba maisCasos de uso

Reconhecimento de imagem
Treinamento distribuído MXNet + SyncBN. Desempenho aumentado em 50%.

NLP
Treinamento distribuído de processamento de linguagem natural. Desempenho aumentado 6 vezes.

Reconhecimento de fala
Conversão de fala em texto. Texto enviado aos alunos e exibido na tela quando os alunos estão falando.

CTR (taxa de cliques)
Treinamento distribuído. Desempenho aumentado 6,6 vezes.
Ofertas especiais
Elastic GPU Service
Recursos poderosos de computação paralela baseados em tecnologia GPU
15% OFF
• Deep Learning
• Processamento de vídeo
• Computação científica
File Storage NAS
Armazenamento conectado à rede simples, escalável, sob demanda e confiável para uso com instâncias ECS, HPC e Container Service
25% OFF
• Pagamento por uso
• Sistemas de arquivos NAS Capacity
• Sistemas de arquivos NAS Performance
Container Registry
Uma plataforma de nível empresarial que oferece gerenciamento seguro e distribuição eficiente de imagens de contêiner
• ACR EE Advanced Edition
• Segurança de nível empresarial
• Distribuição global acelerada
Platform for AI
Uma plataforma de ponta a ponta para mineração e análise de dados
• Interface visualizada
• Mais de 100 componentes de algoritmos
• Alta capacidade de computação
Segurança e conformidade
-
CSA STAR -
ISO 27001 -
SOC2 Type II Report -
C5 -
MLPS 2.0 -
MTCS
Recursos relacionados
Whitepaper
Whitepaper de aceleração de IA
Este whitepaper é um guia completo sobre o mecanismo da camada de infraestrutura de IA e como ela suporta a aceleração de IA
Saiba mais >Melhor prática
cGPU (compartilhamento de GPU) para inferência de IA
Este documento apresenta o processo de implantação do componente cGPU no ambiente ACK
Saiba mais >Melhor prática
Demo de aceleração de IA - AIACC + ACK (Tensorflow)
Esta demo ajuda você a treinar dados do ImageNet com Tensorflow 2.4 aproveitando o AIACC, um mecanismo de aceleração de IA executado no ACK (K8s), para acelerar seu treinamento de IA
Saiba mais >Melhor prática
Demo de aceleração de IA - AIACC (TensorFlow)
Esta solução ajuda você a treinar o ImageNet com TensorFlow 2.4 aproveitando o AIACC, um mecanismo de aceleração de IA, para acelerar seu treinamento de IA
Saiba mais >Melhor prática
Demo de aceleração de IA - AIACC + ACK (Pytorch)
Esta solução ajuda você a treinar dados do ImageNet com Pytorch 1.9 aproveitando o AIACC, um mecanismo de aceleração de IA executado no ACK (K8s), para acelerar seu treinamento de IA
Saiba mais >Curso online
Acelerando tarefas de deep learning com AIACC
Esta demo mostra como é possível alcançar de 18% a 74% sem alterações no código TensorFlow existente e demonstra o poder do AIACC usando tanto o conjunto de dados padrão MNIST de dígitos manuscritos quanto amostras de radiografias de tórax de COVID-19
Saiba mais >Comece com as soluções do Alibaba Cloud
Conheça e experimente o poder do Alibaba Cloud.
Falar com vendas