Alibaba Mengumumkan Upgrade AI Full-Stack Komprehensif untuk Era Agen
Alibaba Cloud 20 Mei 2026
Qwen3.7-Max, infrastruktur cloud dan layanan model yang di-upgrade, serta chip T-Head baru diumumkan di Alibaba Cloud Summit
Hangzhou, Tiongkok, 20 Mei 2026 – Alibaba hari ini mengumumkan upgrade komprehensif dari stack AI penuhnya—yang mencakup infrastruktur cloud dan layanan model, chip AI, dan model dasar —untuk memberdayakan pelanggan dalam buat, men-deploy, dan menskalakan Agen AI dengan efisiensi, keandalan, dan performa yang lebih besar.
Diungkap di Alibaba Cloud Summit, Qwen3.7-Max adalah model bahasa besar terbaru Alibaba, yang direkayasa untuk pengodean agen advanced, penalaran kompleks, dan eksekusi task jangka panjang. Qwen3.7-Max akan segera tersedia untuk developer dan perusahaan di seluruh dunia.
Untuk mengatasi lonjakan permintaan komputasi dan workload AI di era agen, Alibaba Cloud juga telah melakukan upgrade pada infrastruktur dan layanan model miliknya. launch utama termasuk Panjiu AL128 Supernode Server, yang dirancang untuk memberdayakan Inferensi Agen yang dapat diskalakan dan Pelatihan model berskala besar, serta update pengoptimalan dalam platform layanan model Alibaba yang secara terus-menerus menyempurnakan performa model.
Selain itu, T-Head, anak perusahaan desain semikonduktor Alibaba, memperkenalkan Zhenwu M890, Prosesor Pelatihan AI dan Inferensi terbarunya, yang memiliki fitur memori berkapasitas tinggi, bandwidth antar-chip yang kuat, dan dukungan Presisi FP4 native.
Qwen 3.7-Max: Model Dasar Serbaguna untuk Era Agen
Dirancang sebagai dasar yang kuat untuk Agen AI, Qwen 3.7-Max secara mulus men-handle pembuatan dan debugging kode, otomatisasi workflow kantor, dan task multi-langkah kompleks yang membutuhkan ratusan atau ribuan tindakan.
model ini mengirimkan kemampuan Agen luar biasa di berbagai domain. Sebagai asisten pengodean tingkat frontier, model ini mendukung task pengodean dari pembuatan prototipe antarmuka depan yang cepat hingga rekayasa perangkat lunak multi-file yang kompleks. Untuk meningkatkan produktivitas kerja kantor, model ini secara andal mengatur workflow multi-agen untuk menangani operasi yang canggih. Secara khusus, Qwen 3.7-Max dapat secara otonom melakukan eksekusi task agen jangka panjang—mempertahankan operasi berkelanjutan hingga 35 jam dan mengelola lebih dari 1.000 panggilan tool tanpa degradasi performa.
Sangat dioptimalkan untuk framework Agen terkemuka termasuk OpenClaw, Hermes Agent, Claude Code, Qwen Paw, dan Qoder, model ini berfungsi sebagai jaringan tulang punggung yang andal untuk berbagai sistem Agen. model ini mencapai hasil tingkat atas di berbagai benchmark utama dalam pengodean, Agen tujuan umum, kemampuan umum, dan multilingualisme, menjadikannya kompetitif dengan model frontier terkemuka. model ini akan segera dapat di-akses melalui platform layanan model Alibaba, Studio Model, untuk developer global.
Komputasi Cerdas Generasi Berikutnya dan Layanan Model yang Ditingkatkan
Untuk memberdayakan Inferensi Agen AI yang dapat diskalakan dan Pelatihan model berskala besar, Alibaba Cloud telah meluncurkan Panjiu AL128 Supernode Server, yang ditenagai oleh Prosesor AI Zhenwu M890 dan chip jaringan ICN Switch 1.0. Dengan mengintegrasikan secara erat 128 akselerator AI dalam satu rak, sistem ini mengirimkan bandwidth rak tunggal pada skala petabyte per detik (PB/s), secara dramatis meningkatkan penanganan permintaan bersamaan berskala besar dari Agen.
Panjiu AL128 sekarang tersedia di Studio Model untuk pasar Tiongkok (atau "Bailian"), mengaktifkan perusahaan Tiongkok untuk secara efisien mengatasi permintaan Pelatihan dan Inferensi di berbagai sektor.
Untuk mengoptimalkan performa, Bailian telah memperkenalkan Agentic RL, sebuah mekanisme Pembelajaran Penguatan yang didukung oleh feedback eksekusi Agen, untuk mendorong iterasi model yang berkelanjutan. Bailian juga memiliki fitur kemampuan tata kelola keamanan bawaan, memastikan bahwa Agen yang beroperasi secara otonom selalu tetap berada dalam batas yang ditentukan.
Chip dan Tumpukan Perangkat Lunak Terbaru T-Head untuk Pelatihan AI dan Inferensi
Akselerator AI terbaru T-Head, Zhenwu M890, mengirimkan performa tiga kali lipat dari pendahulunya, Zhenwu 810E. Zhenwu M890 memiliki fitur 144 gigabyte (GB) Memori GPU dan bandwidth antar-chip 800 GB per detik. Chip ini mendukung berbagai format Presisi data secara native, mulai dari FP32 (floating-point 32-bit) hingga FP4 (floating-point 4-bit), mendukung Pelatihan model Presisi tinggi dan inferensi model Presisi sangat rendah. Kemampuan ini membuatnya sangat cocok untuk workload AI agen yang kompleks, yang menuntut memori kerja ekstensif untuk retensi konteks, komunikasi berkecepatan tinggi untuk koordinasi multi-agen, dan komputasi Presisi rendah untuk me-maintain eksekusi yang cepat sekaligus mengurangi biaya. Chip ini dibangun di atas arsitektur komputasi paralel eksklusif T-Head dan menggunakan protokol interkoneksi ICN (Inter-Chip Network) kustom miliknya.
Bersamaan dengan akselerator, T-Head meluncurkan ICN Switch 1.0 , sebuah chip switching khusus yang dirancang untuk buat jaringan skalabilitas vertikal latensi rendah dan bandwidth tinggi untuk kluster komputasi. Ini mengirimkan hingga 25,6 Tbps bandwidth agregat dan mencapai latensi ekstrem rendah serta komunikasi bebas kemacetan. Dengan memasangkan Zhenwu M890 dengan chip ICN Switch 1.0, ini mengaktifkan interkoneksi bandwidth penuh di 64 akselerator, secara signifikan meningkatkan efisiensi komputasi dan stabilitas komputasi cerdas skala besar. T-Head juga meluncurkan tumpukan perangkat lunak eksklusifnya, T-Head SAIL™ , untuk melepaskan potensi komputasi penuh untuk chipnya.
T-Head telah mencapai adopsi industri yang luas dari chip AI eksklusifnya, dengan lebih dari 560.000 unit Zhenwu dikirimkan hingga saat ini . Lebih dari 400 pelanggan eksternal di 20 industri, termasuk produsen mobil terkemuka dan perusahaan layanan keuangan, telah men-deploy chip tersebut untuk menggerakkan operasi cerdas.
Tentang Alibaba Group
Alibaba Group adalah perusahaan teknologi global yang berfokus pada e-commerce dan komputasi cloud. Kami mengaktifkan pedagang, brand, dan pengecer untuk memasarkan, menjual, dan berinteraksi dengan konsumen dengan menyediakan infrastruktur digital dan logistik, tool efisiensi, dan jangkauan marketing yang luas. Kami memberdayakan perusahaan dengan infrastruktur cloud, layanan, dan kemampuan kolaborasi kerja terkemuka kami untuk memfasilitasi transformasi digital mereka dan mengembangkan bisnis mereka.
