Layanan GPU Elastis

Instans komputasi elastis dengan akselerator Komputasi GPU yang cocok untuk skenario (seperti artificial
intelligence (khususnya pembelajaran mendalam dan pembelajaran mesin), komputasi Berkinerja-tinggi, dan pemrosesan
grafis profesional)

Dukungan untuk Komputasi Heterogen di Semua Skenario

Layanan GPU Elastis menyediakan sistem layanan lengkap yang menggabungkan perangkat lunak dan perangkat keras untuk membantu Anda mengalokasikan resource secara fleksibel, menyesuaikan skala sistem Anda secara elastis, meningkatkan daya komputasi, dan menurunkan biaya bisnis terkait AI Anda. Ini berlaku untuk skenario (seperti pembelajaran mendalam, Pengkodean video dan decoding, pemrosesan video, komputasi ilmiah, visualisasi grafis, dan cloud gaming).

Layanan GPU Elastis menyediakan kapabilitas komputasi yang diakselerasi GPU dan resource Komputasi GPU yang siap pakai dan dapat disesuaikan skalanya. GPU memiliki keunggulan unik dalam melakukan komputasi matematika dan geometris, khususnya komputasi floating-point dan paralel. GPU menyediakan 100 kali lipat daya komputasi dari mitra CPU-nya.

Kapabilitas Komputasi yang Bervariasi

Ini memiliki sejumlah besar unit logika aritmatika (ALU) yang dapat digunakan untuk komputasi paralel berskala besar. Layanan GPU Elastis menggunakan chip akselerasi GPU terbaru dan menyediakan berbagai kartu akselerator (seperti FPGA, GPU, dan ASIC) untuk melayani tujuan bisnis (seperti AI, grafis, Transkoding, dan Enkripsi).

Kemudahan Penggunaan

resource GPU di-deploy secara global di berbagai lokasi geografis. Unit kontrol logika yang simple memungkinkan Anda untuk menyesuaikan skala sistem Anda berdasarkan persyaratan bisnis Anda. Layanan GPU Elastis juga menyediakan tool bantu (seperti AIACC, FastGPU, dan cGPU).

Kinerja Jaringan Tinggi

Ini menggunakan arsitektur SHENLONG untuk meningkatkan kinerja server dan mengurangi latensi I/O. GPU mendukung hingga 24 juta pps, bandwidth hingga 64 Gbit/s melalui VPC. Ini cocok untuk skenario throughput tinggi di mana berbagai thread berjalan secara paralel untuk memproses task komputasi.

GPU Software for Improving Computing Efficiency

Alibaba Cloud provides auxiliary tools

AIACC-Training

Alibaba Cloud AIACC-Training is an AI accelerator optimized for Alibaba Cloud environments. It can significantly improve the efficiency of AI distributed training and network bandwidth utilization. AIACC-Training has set two world records:
Fastest training speed in the DAWNBench ImageNet competition (held by Stanford University)
Lowest training cost in the DAWNBench ImageNet competition (held by Stanford University)

Learn More >

Features

  • Supports Main Frameworks

    Distributed training frameworks: TensorFlow, PyTorch, MXNet, and Caffe

  • 50%-300% Performance Improvements

    Bandwidth-intensive network models

  • High-Performance Communication for One or More Multi-GPU Servers

    Supports FP16 gradient compression and mixed precision compression

  • API Extensions for MXNet

    Supports data parallelism and model parallelism of the InsightFace type

  • Deep Optimization for RDMA Networks

    Hybrid link communication (RDMA and VPC)

AIACC-Inference

Alibaba Cloud AIACC-Inference is an AI accelerator optimized for Alibaba Cloud environments. It can significantly improve GPU utilization and inference performance. AIACC-Inference has set two world records:
Lowest inference latency in the DAWNBench ImageNet competition (held by Stanford University)
Lowest inference cost in the DAWNBench ImageNet competition (held by Stanford University)

Learn More >

Features

  • Supports Multiple Frameworks

    Tensorflow, Pytorch, MXNet, and other deep learning frameworks can export models in the Open Neural Network Exchange (ONNX) format to improve inference performance

  • 30%-400% Performance Improvements

    Compute-intensive network models

  • Supports Multiple Model Precisions

    Model optimization on FP32 and FP16

GPU Cluster Deployment Tool

Alibaba Cloud FastGPU is a set of fast deployment tools for GPU clusters to help deploy GPU computing resources on the cloud with just a few clicks. FastGPU is simple to configure and can be used anywhere with ease. FastGPU provides a time-saving, cost-effective, and easy-to-use solution for the fast deployment of GPU clusters.

Learn More >

Features

  • Quick Deployment

    API operations for fast deployment of offline training and inference scripts in GPU clusters

  • Easy Management

    Provides a command-line tool to manage the status and lifecycle of GPU clusters

  • Efficient and Time-Saving

    You do not need to perform deployment operations for computing, storage, and network at the IAAS layer of Alibaba Cloud. The appropriate environment is automatically attained when you obtain cluster resources.

GPU Sharing Software for Containers

It allows multiple containers to use a single GPU by splitting and assigning GPU resources to multiple isolated containers. cGPU can run multiple containers on a single GPU and isolate the GPU applications among the containers. This way, the GPU hardware resource utilization is improved.

Learn More >

Features

  • GPU Splitting

    Splits GPU resources to improve GPU utilization

  • GPU Sharing

    Cost savings through GPU sharing across multiple AI applications

  • Flexibility

    Flexibly splits computing power and GPU memory to meet application requirements

Layanan GPU Elastis VS server GPU-accelerated yang dikelola sendiri

Item Layanan GPU Elastis Server GPU-accelerated yang Dikelola Sendiri
Fleksibilitas
· Memungkinkan Anda untuk membuat satu atau beberapa instans yang dipercepat GPU dengan mudah
· Perubahan konfigurasi instans yang fleksibel — ketika instans tidak lagi memenuhi kebutuhan Anda, reboot sederhana sudah cukup untuk mengubah di antara berbagai spesifikasi dalam keluarga yang sama.
· Menyediakan bandwidth yang dapat disesuaikan
· Memerlukan periode subscription yang diperpanjang
· Memiliki konfigurasi yang tidak dapat diubah
· Memerlukan pembelian satu kali bandwidth keluar yang tidak dapat disesuaikan
Kemudahan Penggunaan
· Menyediakan konsol berbasis web untuk management online
· Memiliki sistem operasi arus utama bawaan (seperti sistem operasi Windows asli yang diaktifkan) dan memungkinkan sistem operasi diganti secara online
· Memungkinkan Anda untuk membeli dan menginstal Driver GPU saat Anda membeli instans
· Tidak menyediakan tool management online dan memerlukan management dan pemeliharaan secara manual
・Anda perlu membawa sistem operasi Anda sendiri, menginstal, dan menggantinya sendiri
・Anda harus secara manual menyiapkan dan menginstal sistem operasi
Disaster Recovery dan Pencadangan
· Menyimpan tiga copy dari setiap bagian data. Saat satu copy korup, data dapat dipulihkan dengan cepat
· Kegagalan perangkat keras dapat dipulihkan secara cepat dan secara otomatis
· Anda harus secara manual buat lingkungan disaster recovery dan menggunakan storage device tradisional yang mahal
· Anda harus secara manual memperbaiki data yang korup
Biaya
· Mendukung metode penagihan subscription dan bayar sesuai pemakaian. Anda dapat memilih metode penagihan yang sesuai berdasarkan kebutuhan bisnis Anda
· Memungkinkan Anda untuk membeli resource sesuai permintaan tanpa melakukan investasi besar di muka
· Mengharuskan Anda untuk membeli resource dengan membayar di muka untuk memenuhi persyaratan konfigurasi jam sibuk
· Memerlukan investasi di muka yang besar dan mengakibatkan pemborosan resource

Skenario

Solusi Terkemuka di Industri dan Kinerja Tinggi

Layanan GPU Elastis Alibaba Cloud menyediakan solusi terkemuka di industri yang dapat memberikan kinerja tinggi, skalabilitas, dan keandalan tingkat perusahaan pada simulasi dan analisis rekayasa. Dengan bantuan ukuran Memori GPU yang besar dan kinerja GPU yang tinggi, Anda dapat memanfaatkan daya komputasinya untuk melakukan simulasi kompleks dan memecahkan masalah yang menantang.

Manfaat

  • Solusi yang Dioptimalkan

    Memanfaatkan pemodelan CFD untuk mengurangi waktu resolusi secara signifikan

  • Desain Elektronik Elektromagnetik Komputasi yang Dipercepat

    Membantu mendesain produk dan komponen elektronik Berkinerja-tinggi dengan mensimulasikan kinerja elektromagnetik dan memprediksi radiasi, interferensi, dan transmisi elektromagnetik

  • Simulasi Rekayasa

    Aplikasi tervirtualisasi di cloud yang meningkatkan produktivitas dan menghemat anggaran IT

Pemrosesan Video HD untuk Tampilan Terbaik

Task pemrosesan video sering menghadapi masalah (seperti volume data yang besar dan waktu pemrosesan yang lama). GPU dapat menghitung task secara paralel dan dapat digunakan untuk optimasi pemrosesan video. GPU terutama digunakan di field (seperti Transkoding video definisi tinggi berskala besar, livestreaming 4K dan 8K, konferensi video multi-user, dan perbaikan Sumber video).

Manfaat

  • Berkinerja-tinggi

    Optimasi untuk meningkatkan kinerja komputasi

  • Daya Komputasi Superior

    Mendukung pemrosesan cepat data multi-frame dan daya komputasi untuk memproses sejumlah besar task komputasi

Komputasi Berkinerja-tinggi

GPU memainkan peran penting dalam komputasi ilmiah (seperti prediksi meteorologi, eksplorasi hidrokarbon, dan penelitian dinamika molekuler), yang memerlukan komputasi paralel berskala besar. Dikombinasikan dengan komputasi elastis, GPU menyediakan daya komputasi yang diperlukan untuk operasi floating-point skala besar. Daya komputasi tersebut tersedia secara online dan offline.

Manfaat

  • Penyesuaian Skala Otomatis

    Terintegrasi dengan ESS dan SLB untuk menerapkan Penyesuaian Skala Otomatis

  • Daya Komputasi Superior

    Menyediakan GPU terbaru dan metode deployment cepat untuk memenuhi persyaratan komputasi yang besar dari komputasi ilmiah

Kisah Sukses

Faktor penentu terbesar adalah akurasi pengenalan - Platform Vision AI mengenali pelat nomor untuk pemrosesan mosaik dengan akurasi lebih dari 90% dari awal proses validasi.

Setelah penyesuaian mendetail lebih lanjut, sistem dapat secara otomatis melakukan pengenalan dan pemrosesan mosaik dengan akurasi lebih dari 95% pada saat diperkenalkan.

– Bpk. Chiaki Uchiyama, Pemimpin Seksi, Seksi Pemasaran Frima, Divisi Frima, IDOM Co.

IDOM Inc. (Chiyoda-ku, Tokyo) mengoperasikan bisnis penjualan dan pembelian mobil bekas yang men-handle salah satu data distribusi kendaraan skala terbesar di Jepang, baru-baru ini membuka toko berukuran super dengan layanan pemeliharaan, lembaran logam, dan purnajual yang enhanced.

Platform IDOM mengizinkan user untuk secara bebas mengunggah foto kendaraan yang mereka rencanakan untuk dijual, tetapi menghadapi masalah batasan self-service dan peningkatan jam kerja karena pemeriksaan manual dan pengerjaan ulang. Alibaba Cloud dapat membantu menyediakan teknologi Pengenalan gambar yang sangat akurat dan dukungan tatap muka.

Ms-meta.HK memanfaatkan berbagai layanan oleh Alibaba Cloud dalam implementasi solusinya. layanan ini (bersama dengan pakar teknis lokal Alibaba Cloud dan tim dukungan khusus) memungkinkan Ms-meta.HK untuk dengan mudah me-launch penawaran Metaverse-nya ke publik.

Ms-meta.HK adalah proyek Metaverse terdesentralisasi yang digerakkan oleh komunitas yang berbasis di Hong Kong. Ms-meta.HK secara aktif memanfaatkan teknologi rendering cloud dan distribusi traffic Alibaba Cloud di Metaverse-nya. Berkolaborasi dengan Alibaba Cloud memungkinkan Ms-meta.HK untuk mengoptimalkan adegan virtual di Metaverse-nya dan mengurangi waktu pemuatan untuk memberikan pengalaman user yang lebih baik kepada pelanggan. Selain itu, perusahaan dapat melindungi server-nya yang terekspos ke publik berkat penawaran keamanan yang kuat dari Alibaba Cloud. Ms-meta.HK berharap dapat lebih mengoptimalkan layanan infrastruktur Metaverse-nya dengan bantuan Alibaba Cloud.

Sebagai bagian dari bisnis intinya, ADVANCE memanfaatkan berbagai solusi penyimpanan data dan management cloud-native di Alibaba Cloud untuk me-manage gudang data dan proses analitik data untuk algoritma AI dan pembelajaran mesinnya. Misalnya, ADVANCE menggunakan Database Apsara for Redis untuk caching dalam memori dan akses berkecepatan tinggi, Database Apsara for MongoDB untuk penyimpanan Data semi-terstruktur dan fleksibel, DataWorks untuk agregasi data, pemrosesan, dan tata kelola di antara berbagai Sumber data, dan Realtime Compute for Apache Flink untuk pemrosesan data besar real-time.

Advance Intelligence Group (ADVANCE) adalah perusahaan teknologi yang digerakkan oleh AI di Asia-Pasifik dan salah satu pemain teratas di pasar Asia Tenggara (SEA), khususnya di Indonesia.

ADVANCE berkomitmen untuk menyediakan layanan AI yang enhanced kepada pelanggannya. Alibaba Cloud akan terus mendukung ADVANCE untuk mencapai kesuksesan melalui layanan infrastruktur cloud yang inovatif. Kombinasi AI dan komputasi cloud akan memberikan lebih banyak nilai bagi pelanggan dengan efisiensi, produktivitas, dan keamanan digital yang lebih besar.

phone Hubungi Kami
Hi, I'm Alibaba Cloud AI Assistant!
I can help with questions and solutions.