Alibaba annonce une mise à niveau complète de son offre IA full-stack pour l'ère des agents
Alibaba Cloud 20 mai 2026
Qwen3.7-Max, infrastructure cloud et services de modèles améliorés, et nouvelles puces T-Head annoncés lors du sommet Alibaba Cloud
Hangzhou, Chine, 20 mai 2026 – Alibaba a annoncé aujourd'hui une mise à niveau complète de sa pile IA full-stack – couvrant l'infrastructure cloud et les services de modèles, les puces IA et les modèles de fondation – afin de permettre à ses clients de créer, déployer et faire évoluer des agents IA avec une efficacité, une fiabilité et des performances accrues.
Dévoilé lors du sommet Alibaba Cloud, Qwen3.7-Max est le dernier grand modèle de langage d'Alibaba, conçu pour le codage agentique avancé, le raisonnement complexe et l'exécution de tâches à long horizon. Qwen3.7-Max sera bientôt disponible pour les développeurs et les entreprises du monde entier.
Pour répondre à la demande croissante en calcul et en charges de travail IA dans l'ère des agents, Alibaba Cloud a également amélioré son infrastructure et ses services de modèles. Les lancements clés incluent le Serveur Supernode Panjiu AL128, conçu pour permettre l'inférence évolutive des agents et l'entraînement de modèles à grande échelle, ainsi qu'une mise à jour d'optimisation au sein de la plateforme de services de modèles d'Alibaba qui affine continuellement les performances des modèles.
Par ailleurs, T-Head, filiale de conception de semi-conducteurs d'Alibaba, a présenté le Zhenwu M890, son dernier processeur d'entraînement et d'inférence IA, doté d'une mémoire haute capacité, d'une bande passante inter-puces robuste et d'une prise en charge native de la précision FP4.
Qwen 3.7-Max : un modèle de fondation polyvalent pour l'ère des agents
Conçu comme une base robuste pour les agents IA, Qwen 3.7-Max gère de manière transparente la génération et le débogage de code, l'automatisation des flux de travail bureautiques et les tâches complexes en plusieurs étapes nécessitant des centaines ou des milliers d'actions.
Le modèle offre des capacités exceptionnelles d'agent dans divers domaines. En tant qu'assistant de codage de niveau frontière, il prend en charge les tâches de codage allant du prototypage frontend rapide à l'ingénierie logicielle complexe multi-fichiers. Pour améliorer la productivité du travail bureautique, il orchestre de manière fiable des flux de travail multi-agents pour affronter des opérations sophistiquées. Notamment, Qwen 3.7-Max peut exécuter de manière autonome des tâches agentiques à long horizon – maintenant une opération continue pendant jusqu'à 35 heures et gérant plus de 1 000 appels d'outils sans dégradation des performances.
Profondément optimisé pour les principaux frameworks d'agents, notamment OpenClaw, Hermes Agent, Claude Code, Qwen Paw et Qoder, il sert de colonne vertébrale fiable pour différents systèmes d'agents. Le modèle obtient des résultats de premier rang dans les principaux benchmarks en codage, agents polyvalents, capacités générales et multilinguisme, ce qui le rend compétitif face aux modèles frontières leaders. Il sera bientôt accessible via la plateforme de services de modèles d'Alibaba, Model Studio, pour les développeurs du monde entier.
Informatique intelligente de nouvelle génération et services de modèles améliorés
Pour permettre l'inférence évolutive des agents IA et l'entraînement de modèles à grande échelle, Alibaba Cloud a lancé le Serveur Supernode Panjiu AL128, alimenté par le processeur IA Zhenwu M890 et la puce réseau ICN Switch 1.0. En intégrant étroitement 128 accélérateurs IA au sein d'un seul rack, le système offre une bande passante monorack à l'échelle du pétaoctet par seconde (Po/s), améliorant considérablement la gestion des demandes concurrentes à grande échelle provenant des agents.
Le Panjiu AL128 est désormais disponible sur Model Studio pour le marché chinois (ou « Bailian »), permettant aux entreprises chinoises de répondre efficacement aux besoins d'entraînement et d'inférence dans tous les secteurs.
Pour optimiser les performances, Bailian a introduit Agentic RL, un mécanisme d'apprentissage par renforcement alimenté par le retour d'exécution des agents, pour piloter l'itération continue des modèles. Bailian dispose également de capacités intégrées de gouvernance de sécurité, garantissant que les agents fonctionnant de manière autonome restent toujours dans les limites définies.
Dernières puces et pile logicielle de T-Head pour l'entraînement et l'inférence IA
Le dernier accélérateur IA de T-Head, le Zhenwu M890, offre des performances triplées par rapport à son prédécesseur Zhenwu 810E. Le Zhenwu M890 dispose de 144 gigaoctets (Go) de mémoire GPU et d'une bande passante inter-puces de 800 Go par seconde. La puce prend nativement en charge plusieurs formats de précision de données, allant du FP32 (virgule flottante 32 bits) au FP4 (virgule flottante 4 bits), prenant en charge à la fois l'entraînement de modèles haute précision et l'inférence de modèles ultra-basse précision. Ces capacités la rendent exceptionnellement bien adaptée aux charges de travail complexes d'IA agentique, qui exigent une mémoire de travail étendue pour la rétention du contexte, une communication haute vitesse pour la coordination multi-agents et un calcul basse précision pour maintenir une exécution rapide tout en réduisant les coûts. La puce est construite sur l'architecture propriétaire de calcul parallèle de T-Head et utilise son protocole d'interconnexion personnalisé ICN (Inter-Chip Network).
Parallèlement à l'accélérateur, T-Head a dévoilé l'ICN Switch 1.0 , une puce de commutation dédiée conçue pour créer des réseaux scale-up à haute bande passante et faible latence pour les clusters de calcul. Elle offre jusqu'à 25,6 Tbps de bande passante agrégée et atteint une latence extrêmement faible et une communication sans congestion. En associant le Zhenwu M890 à la puce ICN Switch 1.0, elle permet une interconnexion pleine bande passante entre 64 accélérateurs, améliorant considérablement l'efficacité computationnelle et la stabilité du calcul intelligent à grande échelle. T-Head a également dévoilé sa pile logicielle propriétaire, T-Head SAIL™ , pour libérer tout le potentiel computationnel de ses puces.
T-Head a obtenu une adoption industrielle généralisée de ses puces IA propriétaires, avec plus de 560 000 unités Zhenwu livrées à ce jour . Plus de 400 clients externes dans 20 secteurs, dont des constructeurs automobiles leaders et des entreprises de services financiers, ont déployé ces puces pour alimenter leurs opérations intelligentes.
À propos d'Alibaba Group
Alibaba Group est une entreprise technologique mondiale axée sur le commerce électronique et le cloud computing. Nous permettons aux marchands, marques et détaillants de commercialiser, vendre et interagir avec les consommateurs en fournissant une infrastructure numérique et logistique, des outils d'efficacité et une vaste portée marketing. Nous donnons aux entreprises les moyens grâce à notre infrastructure cloud leader, nos services et nos capacités de collaboration professionnelle pour faciliter leur transformation numérique et développer leurs activités.
