Alibaba Anuncia Atualização Abrangente de IA Full-Stack para a Era Agêntica

Alibaba Cloud 20 de maio de 2026

Qwen3.7-Max, infraestrutura de nuvem e serviços de modelo atualizados, e novos chips T-Head anunciados no Alibaba Cloud Summit



Hangzhou, China, 20 de maio de 2026 – A Alibaba anunciou hoje uma atualização abrangente de toda a sua pilha de IA — abrangendo infraestrutura de nuvem e serviços de modelo, chips de IA e modelos fundacionais — para capacitar os clientes na criação, implantação e dimensionamento de agentes de IA com maior eficiência, confiabilidade e desempenho.

Revelado no Alibaba Cloud Summit, o Qwen3.7-Max é o mais recente grande modelo de linguagem da Alibaba, projetado para codificação agêntica avançada, raciocínio complexo e execução de tarefas de longo horizonte. O Qwen3.7-Max estará disponível em breve para desenvolvedores e empresas em todo o mundo.

Para atender às crescentes demandas de computação e cargas de trabalho de IA na era agêntica, a Alibaba Cloud também atualizou sua infraestrutura e serviços de modelo. Os principais lançamentos incluem o Servidor Supernode Panjiu AL128, projetado para capacitar a inferência escalável de agentes e o treinamento de modelos em larga escala, e uma atualização de otimização na plataforma de serviços de modelo da Alibaba que refina continuamente o desempenho do modelo.

Além disso, a T-Head, subsidiária de design de semicondutores da Alibaba, apresentou o Zhenwu M890, seu mais recente processador de treinamento e inferência de IA, com memória de alta capacidade, largura de banda robusta entre chips e suporte nativo à precisão FP4.

Qwen 3.7-Max: Um Modelo Fundacional Versátil para a Era dos Agentes

Projetado como uma base robusta para agentes de IA, o Qwen 3.7-Max lida perfeitamente com a geração e depuração de código, automação de fluxo de trabalho de escritório e tarefas complexas de várias etapas que exigem centenas ou milhares de ações.

O modelo oferece recursos excepcionais de agente em diversos domínios. Como um assistente de codificação de nível de fronteira, ele oferece suporte a tarefas de codificação, desde a prototipagem rápida de frontend até a engenharia de software complexa de vários arquivos. Para aumentar a produtividade do trabalho de escritório, ele orquestra de forma confiável fluxos de trabalho multiagentes para lidar com operações sofisticadas. Notavelmente, o Qwen 3.7-Max pode executar autonomamente tarefas agênticas de longo horizonte — sustentando a operação contínua por até 35 horas e gerenciando mais de 1.000 chamadas de ferramentas sem degradação de desempenho.

Profundamente otimizado para os principais frameworks de agentes, incluindo OpenClaw, Hermes Agent, Claude Code, Qwen Paw e Qoder, ele atua como uma espinha dorsal confiável para diferentes sistemas de agentes. O modelo alcança resultados de alto nível nos principais benchmarks de codificação, agentes de uso geral, capacidades gerais e multilinguismo, tornando-o competitivo com os principais modelos de fronteira. Ele estará acessível em breve através da plataforma de serviços de modelo Model Studio da Alibaba para desenvolvedores globais.

Computação Inteligente de Próxima Geração e Serviços de Modelo Aprimorados

Para capacitar a inferência escalável de Agentes de IA e o treinamento de modelos em larga escala, a Alibaba Cloud lançou o Servidor Supernode Panjiu AL128, equipado com o processador de IA Zhenwu M890 e o chip de rede ICN Switch 1.0. Ao integrar de forma coesa 128 aceleradores de IA em um único rack, o sistema oferece largura de banda de rack único na escala de petabytes por segundo (PB/s), melhorando drasticamente o tratamento de solicitações simultâneas em larga escala de agentes.

O Panjiu AL128 já está disponível no Model Studio para o mercado chinês (ou "Bailian"), permitindo que as empresas chinesas atendam com eficiência às demandas de treinamento e inferência em vários setores.

Para otimizar o desempenho, o Bailian introduziu o Agentic RL, um mecanismo de aprendizado por reforço impulsionado pelo feedback de execução do agente, para conduzir a iteração contínua do modelo. O Bailian também possui recursos integrados de governança de segurança, garantindo que os agentes que operam de forma autônoma permaneçam sempre dentro dos limites definidos.

Os Mais Recentes Chips e Pilha de Software da T-Head para Treinamento e Inferência de IA

O mais recente acelerador de IA da T-Head, o Zhenwu M890, oferece três vezes o desempenho de seu antecessor, o Zhenwu 810E. O Zhenwu M890 possui 144 gigabytes (GB) de memória de GPU e 800 GB por segundo de largura de banda entre chips. O chip suporta nativamente vários formatos de precisão de dados, variando de FP32 (ponto flutuante de 32 bits) até FP4 (ponto flutuante de 4 bits), suportando tanto o treinamento de modelos de alta precisão quanto a inferência de modelos de precisão ultrabaixa. Esses recursos o tornam excepcionalmente adequado para cargas de trabalho complexas de IA agêntica, que exigem extensa memória de trabalho para retenção de contexto, comunicação de alta velocidade para coordenação multiagentes e computação de baixa precisão para manter a execução rápida enquanto reduz os custos. O chip é construído na arquitetura de computação paralela proprietária da T-Head e utiliza seu protocolo de interconexão ICN (Inter-Chip Network) personalizado.

Junto com o acelerador, a T-Head revelou o ICN Switch 1.0 , um chip de comutação dedicado projetado para criar redes scale-up de alta largura de banda e baixa latência para clusters de computação. Ele oferece até 25,6 Tbps de largura de banda agregada e alcança latência extremamente baixa e comunicação livre de congestionamento. Ao combinar o Zhenwu M890 com o chip ICN Switch 1.0, ele permite a interconexão de largura de banda total entre 64 aceleradores, aumentando significativamente a eficiência computacional e a estabilidade da computação inteligente em larga escala. A T-Head também revelou sua pilha de software proprietária, o T-Head SAIL™ , para liberar todo o potencial computacional de seus chips.

A T-Head alcançou ampla adoção industrial de seus chips de IA proprietários, com mais de 560.000 unidades Zhenwu entregues até o momento . Mais de 400 clientes externos em 20 setores, incluindo as principais montadoras e empresas de serviços financeiros, implantaram os chips para impulsionar operações inteligentes.

Sobre o Alibaba Group

O Alibaba Group é uma empresa global de tecnologia focada em comércio eletrônico e computação em nuvem. Capacitamos comerciantes, marcas e varejistas a comercializar, vender e se envolver com os consumidores, fornecendo infraestrutura digital e logística, ferramentas de eficiência e amplo alcance de marketing. Capacitamos as empresas com nossa infraestrutura líder de nuvem, serviços e recursos de colaboração de trabalho para facilitar sua transformação digital e expandir seus negócios.

phone Fale Conosco
Oi, eu sou o assistente de IA da Alibaba Cloud!
Posso ajudar com perguntas e soluções.