Dukungan untuk Komputasi Heterogen di Semua Skenario
Layanan GPU Elastis menyediakan sistem layanan lengkap yang menggabungkan perangkat lunak dan perangkat keras untuk membantu Anda mengalokasikan resource secara fleksibel, menyesuaikan skala sistem Anda secara elastis, meningkatkan daya komputasi, dan menurunkan biaya bisnis terkait AI Anda. Ini berlaku untuk skenario (seperti pembelajaran mendalam, Pengkodean video dan decoding, pemrosesan video, komputasi ilmiah, visualisasi grafis, dan cloud gaming).
Layanan GPU Elastis menyediakan kapabilitas komputasi yang diakselerasi GPU dan resource Komputasi GPU yang siap pakai dan dapat disesuaikan skalanya. GPU memiliki keunggulan unik dalam melakukan komputasi matematika dan geometris, khususnya komputasi floating-point dan paralel. GPU menyediakan 100 kali lipat daya komputasi dari mitra CPU-nya.
Kapabilitas Komputasi yang Bervariasi
Ini memiliki sejumlah besar unit logika aritmatika (ALU) yang dapat digunakan untuk komputasi paralel berskala besar. Layanan GPU Elastis menggunakan chip akselerasi GPU terbaru dan menyediakan berbagai kartu akselerator (seperti FPGA, GPU, dan ASIC) untuk melayani tujuan bisnis (seperti AI, grafis, Transkoding, dan Enkripsi).
Kemudahan Penggunaan
resource GPU di-deploy secara global di berbagai lokasi geografis. Unit kontrol logika yang simple memungkinkan Anda untuk menyesuaikan skala sistem Anda berdasarkan persyaratan bisnis Anda. Layanan GPU Elastis juga menyediakan tool bantu (seperti AIACC, FastGPU, dan cGPU).
Kinerja Jaringan Tinggi
Ini menggunakan arsitektur SHENLONG untuk meningkatkan kinerja server dan mengurangi latensi I/O. GPU mendukung hingga 24 juta pps, bandwidth hingga 64 Gbit/s melalui VPC. Ini cocok untuk skenario throughput tinggi di mana berbagai thread berjalan secara paralel untuk memproses task komputasi.
GPU Software for Improving Computing Efficiency
AIACC-Training
Alibaba Cloud AIACC-Training is an AI accelerator optimized for Alibaba Cloud environments. It can significantly improve the efficiency of AI distributed training and network bandwidth utilization. AIACC-Training has set two world records:
Fastest training speed in the DAWNBench ImageNet competition (held by Stanford University)
Lowest training cost in the DAWNBench ImageNet competition (held by Stanford University)
Learn More >
Features
-
Supports Main FrameworksDistributed training frameworks: TensorFlow, PyTorch, MXNet, and Caffe
-
50%-300% Performance ImprovementsBandwidth-intensive network models
-
High-Performance Communication for One or More Multi-GPU ServersSupports FP16 gradient compression and mixed precision compression
-
API Extensions for MXNetSupports data parallelism and model parallelism of the InsightFace type
-
Deep Optimization for RDMA NetworksHybrid link communication (RDMA and VPC)
Works Best With
AIACC-Inference
Alibaba Cloud AIACC-Inference is an AI accelerator optimized for Alibaba Cloud environments. It can significantly improve GPU utilization and inference performance. AIACC-Inference has set two world records:
Lowest inference latency in the DAWNBench ImageNet competition (held by Stanford University)
Lowest inference cost in the DAWNBench ImageNet competition (held by Stanford University)
Learn More >
Features
-
Supports Multiple FrameworksTensorflow, Pytorch, MXNet, and other deep learning frameworks can export models in the Open Neural Network Exchange (ONNX) format to improve inference performance
-
30%-400% Performance ImprovementsCompute-intensive network models
-
Supports Multiple Model PrecisionsModel optimization on FP32 and FP16
Works Best With
GPU Cluster Deployment Tool
Alibaba Cloud FastGPU is a set of fast deployment tools for GPU clusters to help deploy GPU computing resources on the cloud with just a few clicks. FastGPU is simple to configure and can be used anywhere with ease. FastGPU provides a time-saving, cost-effective, and easy-to-use solution for the fast deployment of GPU clusters.
Learn More >
Features
-
Quick DeploymentAPI operations for fast deployment of offline training and inference scripts in GPU clusters
-
Easy ManagementProvides a command-line tool to manage the status and lifecycle of GPU clusters
-
Efficient and Time-SavingYou do not need to perform deployment operations for computing, storage, and network at the IAAS layer of Alibaba Cloud. The appropriate environment is automatically attained when you obtain cluster resources.
Works Best With
GPU Sharing Software for Containers
It allows multiple containers to use a single GPU by splitting and assigning GPU resources to multiple isolated containers. cGPU can run multiple containers on a single GPU and isolate the GPU applications among the containers. This way, the GPU hardware resource utilization is improved.
Learn More >
Features
-
GPU SplittingSplits GPU resources to improve GPU utilization
-
GPU SharingCost savings through GPU sharing across multiple AI applications
-
FlexibilityFlexibly splits computing power and GPU memory to meet application requirements
Works Best With
Layanan GPU Elastis VS server GPU-accelerated yang dikelola sendiri
| Item | Layanan GPU Elastis | Server GPU-accelerated yang Dikelola Sendiri |
|---|---|---|
|
|
· Memungkinkan Anda untuk membuat satu atau beberapa instans yang dipercepat GPU dengan mudah · Perubahan konfigurasi instans yang fleksibel — ketika instans tidak lagi memenuhi kebutuhan Anda, reboot sederhana sudah cukup untuk mengubah di antara berbagai spesifikasi dalam keluarga yang sama. · Menyediakan bandwidth yang dapat disesuaikan |
· Memerlukan periode subscription yang diperpanjang · Memiliki konfigurasi yang tidak dapat diubah · Memerlukan pembelian satu kali bandwidth keluar yang tidak dapat disesuaikan |
|
|
· Menyediakan konsol berbasis web untuk management online · Memiliki sistem operasi arus utama bawaan (seperti sistem operasi Windows asli yang diaktifkan) dan memungkinkan sistem operasi diganti secara online · Memungkinkan Anda untuk membeli dan menginstal Driver GPU saat Anda membeli instans |
· Tidak menyediakan tool management online dan memerlukan management dan pemeliharaan secara manual ・Anda perlu membawa sistem operasi Anda sendiri, menginstal, dan menggantinya sendiri ・Anda harus secara manual menyiapkan dan menginstal sistem operasi |
|
|
· Menyimpan tiga copy dari setiap bagian data. Saat satu copy korup, data dapat dipulihkan dengan cepat · Kegagalan perangkat keras dapat dipulihkan secara cepat dan secara otomatis |
· Anda harus secara manual buat lingkungan disaster recovery dan menggunakan storage device tradisional yang mahal · Anda harus secara manual memperbaiki data yang korup |
|
|
· Mendukung metode penagihan subscription dan bayar sesuai pemakaian. Anda dapat memilih metode penagihan yang sesuai berdasarkan kebutuhan bisnis Anda · Memungkinkan Anda untuk membeli resource sesuai permintaan tanpa melakukan investasi besar di muka |
· Mengharuskan Anda untuk membeli resource dengan membayar di muka untuk memenuhi persyaratan konfigurasi jam sibuk · Memerlukan investasi di muka yang besar dan mengakibatkan pemborosan resource |
Skenario
Solusi Terkemuka di Industri dan Kinerja Tinggi
Layanan GPU Elastis Alibaba Cloud menyediakan solusi terkemuka di industri yang dapat memberikan kinerja tinggi, skalabilitas, dan keandalan tingkat perusahaan pada simulasi dan analisis rekayasa. Dengan bantuan ukuran Memori GPU yang besar dan kinerja GPU yang tinggi, Anda dapat memanfaatkan daya komputasinya untuk melakukan simulasi kompleks dan memecahkan masalah yang menantang.
Manfaat
-
Solusi yang DioptimalkanMemanfaatkan pemodelan CFD untuk mengurangi waktu resolusi secara signifikan
-
Desain Elektronik Elektromagnetik Komputasi yang DipercepatMembantu mendesain produk dan komponen elektronik Berkinerja-tinggi dengan mensimulasikan kinerja elektromagnetik dan memprediksi radiasi, interferensi, dan transmisi elektromagnetik
-
Simulasi RekayasaAplikasi tervirtualisasi di cloud yang meningkatkan produktivitas dan menghemat anggaran IT
Paling Cocok Dengan
Pemrosesan Video HD untuk Tampilan Terbaik
Task pemrosesan video sering menghadapi masalah (seperti volume data yang besar dan waktu pemrosesan yang lama). GPU dapat menghitung task secara paralel dan dapat digunakan untuk optimasi pemrosesan video. GPU terutama digunakan di field (seperti Transkoding video definisi tinggi berskala besar, livestreaming 4K dan 8K, konferensi video multi-user, dan perbaikan Sumber video).
Manfaat
-
Berkinerja-tinggiOptimasi untuk meningkatkan kinerja komputasi
-
Daya Komputasi SuperiorMendukung pemrosesan cepat data multi-frame dan daya komputasi untuk memproses sejumlah besar task komputasi
Paling Cocok Dengan
Komputasi Berkinerja-tinggi
GPU memainkan peran penting dalam komputasi ilmiah (seperti prediksi meteorologi, eksplorasi hidrokarbon, dan penelitian dinamika molekuler), yang memerlukan komputasi paralel berskala besar. Dikombinasikan dengan komputasi elastis, GPU menyediakan daya komputasi yang diperlukan untuk operasi floating-point skala besar. Daya komputasi tersebut tersedia secara online dan offline.
Manfaat
-
Penyesuaian Skala OtomatisTerintegrasi dengan ESS dan SLB untuk menerapkan Penyesuaian Skala Otomatis
-
Daya Komputasi SuperiorMenyediakan GPU terbaru dan metode deployment cepat untuk memenuhi persyaratan komputasi yang besar dari komputasi ilmiah
