阿里巴巴發布Wan2.6系列模型,人人皆可成為視頻主角
阿里雲 2025年12月16日
全新視覺產生模型助力全球創作者提升電影級、專業級視頻製作水平
中國杭州,2025年12月16日 — 阿里巴巴今日發布了其視覺產生模型的最新進化版本——Wan2.6系列。 該系列使創作者能夠以自身形象和聲音出現在AI產生的視頻中,並支援靈活的多情境敘事——這些新功能旨在為專業級內容製作解鎖更多創作可能,同時增強多人物對話能力,延長視頻時間長度,以實現更豐富的敘事表達。
Wan2.6系列包含一款全新的參考生視頻產生模型,以及對現有四款模型的全面升級。 Wan2.6-R2V使使用者能夠上傳包含外貌和聲音的角色參考視頻,通過文本提示詞產生同一角色出鏡的生動新情境。 使用者可以建立包含人物、動物或物體,甚至多個主體共同出鏡的視頻,同時保留原始參考對象的獨特外觀和聲音。
憑藉多模態參考產生能力,Wan2.6-R2V是中國首款參考生視頻產生模型,使用者能夠利用該模型將自身或其他主體插入AI產生情境中,並保持視覺和音訊一致性。 這改變了短劇創作者的敘事方式,並簡化了製作流程。
Wan2.6系列還包括對文生視頻模型(Wan2.6-T2V)、圖生視頻模型(Wan2.6-I2V)以及兩款生圖模型(Wan2.6-image和Wan2.6-T2I)的改進。
新模型引入了智能多情境敘事能力,使敘事更豐富、更具表現力,同時保持視覺一致性。 其在音畫同步和音頻生視頻方面的能力改進能夠呈現更逼真的情境和更豐富的音效。
該系列模型支援最長15秒的視頻輸出,為創作者提供了更大的故事發展空間。 結合經增強指令遵循精度和經改進的視覺品質,該系列模型能讓創作者製作出專業級效果的電影風格內容。
在映像產生方面,Wan2.6系列能讓使用者建立圖文交錯的輸出,並且模型具備先進的邏輯推理能力,可進一步支援連貫的視覺敘事。 該系列模型還在精確的藝術風格把控方面表現出色,能夠產生具有卓越逼真度的逼真肖像,並支援影像處理。 創作者還能受益於其對中英文長文本提示詞的深度理解,從而產生高品質、富有表現力的視覺內容,精準捕捉細節和藝術意圖。
使用者可通過阿里雲AI開發平台百鍊及通義萬相官方網站訪問和部署這些模型。 這些模型還將整合到阿里巴巴旗艦AI應用千問App中。
通義萬相系列於今年早些時候首次亮相,並且經過持續升級,這體現了阿里巴巴在AI驅動型多媒體技術領域的領導力和創新能力。
關於阿里巴巴集團
阿里巴巴集團是一家全球化科技企業,聚焦於電子商務和雲端運算。 我們通過提供數字與物流基礎設施、提效工具以及廣闊的營銷觸達能力,助力商家、品牌和零售商進行營銷、銷售以及與消費者互動。 我們依託領先的雲基礎設施、服務以及協同辦公能力為企業賦能,促進其數字化轉型並實現業務增長。
通義千問(Qwen)是阿里巴巴自研打造的一系列大語言模型與多模態AI模型。 千問大模型於2023年首次亮相,其開放權重版本已通過HuggingFace和ModelScope魔搭社區面向全球開發人員開放。
