阿里巴巴推出Wan2.7,重塑個人化高精度映像建立
阿里雲 2026年4月1日
全新的映像產生模型為專業映像設計帶來鮮明的個人化表達和精準的色彩控制能力
中國杭州,2026年4月1日 — 阿里巴巴今天宣布推出Wan2.7-Image,這是一種統一的AI模型,旨在通過顯著提升創作者以專業級精度製作高保真、個人化視覺素材的能力,顛覆映像產生與編輯行業格局。
傳統上,人工智慧產生的映像一直受到外觀普通和色彩效果不可預測的困擾。 Wan2.7-Image突破了早期的這些短板,為創作者提供完備的工具,使其能夠製作專業、定製化的作品,擺脫以往使用人工智慧反覆調試、頻頻踩坑的困擾。
作為專為處理設計過程每一步而開發的一體化創作工具,Wan2.7-Image讓創作者能夠從文本產生映像,同時通過一次處理多個映像來提高工作效率。 該工具通過簡單的基於指令的編輯功能,輕鬆最佳化視覺效果。 在匿名的人類偏好測試中,該模型通過提供出色的視覺逼真度、精確的文本渲染以及對複雜視覺概念的深刻理解,在綜合表現上超越了領先的行業競爭者。
Wan2.7-Image在最近的人類盲測中表現出色
Wan2.7-Image使用深度個人化元素取代典型AI的通用標準化外觀。 使用者因而能夠微調骨骼結構和眼睛形狀等特定特徵,為每個專案量身打造真正獨特、逼真的角色。 該模型還通過全新的“調色盤”功能終結了AI色彩渲染的猜測工作:只需在提示詞中輸入特定的顏色代碼和比例,創作者便可再現複雜的藝術風格或鎖定精準的品牌顏色,確保每張映像均完美契合創作者的設計構想或企業視覺指導原則。
由Wan2.7-Image建立的映像
Wan2.7-Image展示理想的色彩控制能力
此外,Wan2.7-Image也標誌著文本渲染領域的重大突破,這對AI而言是一個持續存在的挑戰。 得益於可處理超長序列的長上下文學習架構,Wan2.7-Image支援最高3,000個詞元的文本輸入。 該模型支援12種語言,可產生列印品質的學術文本、複雜的公式及表格。 該模型能夠使用多達9張參考映像,並一次產生多達12張映像,因此可輕鬆製作風格統一的分鏡指令碼、建築效果圖和電子商務活動素材。
Wan2.7-Image支援長文本渲染,資料來源:https://arxiv.org/abs/2503.14482
這款全新模型搭載直觀的“點擊編輯”介面,精準把控每一處細節,進一步賦能創作者。 通過選擇映像的特定地區,使用者可按像素級精度無縫添加、移動或對齊各個元素,有效避免通常與AI產生的內容相關的不可預測性。
這種精度由先進的架構提供支援,該架構打通了語言與視覺之間的轉換壁壘。 通過對大量不同的資料集進行訓練,Wan2.7-Image超越了簡單的像素匹配範疇,實現了對照明、構圖和布局的深入語義理解。 模型因此能夠以更高的準確性說明使用者意圖。
今天還發布了Wan2.7-Image-Pro,該模型提供更穩定的構圖功能,對提示詞的理解更清晰和精確,並且具有高清4K輸出。
使用者可以通過百鍊、阿里雲AI開發平台以及通義萬相官方網站訪問和部署模型。 這些模型還將整合到阿里巴巴的旗艦AI應用程式,即千問應用程式中。
通義萬相系列於2023年早些時候首次發布,此後曆經持續迭代升級,彰顯了阿里巴巴在AI驅動的多媒體技術方面的行業領導地位與創新實力。
關於阿里巴巴集團
阿里巴巴集團是一家聚焦電子商務與雲端運算的全球科技公司。 我們通過提供數字與物流基礎設施、提效工具以及廣闊的營銷觸達能力,助力商家、品牌和零售商進行營銷、銷售以及與消費者互動。 我們依託領先的雲基礎設施、服務以及協同辦公能力為企業賦能,促進其數字化轉型並實現業務增長。
