Alibaba、通義万相 (Wan) 2.6 シリーズを発表 — 誰もが主役になれる動画制作を実現
Alibaba Cloud 2025 年 12 月 16 日
新たな映像生成モデルが、世界のクリエイター向けに映画品質のプロフェッショナルな動画制作を向上
中国・杭州市、2025 年 12 月 16 日 - Alibaba は本日、映像生成モデルの最新進化となる Wan2.6 シリーズを発表しました。クリエイターが自分自身の姿と声で AI 生成動画に出演できるようになり、柔軟なマルチショットストーリーテリングに対応する新機能により、複数人での対話強化や映像尺の延長を実現し、プロフェッショナルグレードのコンテンツ制作における創造的な可能性を切り開きます。
Wan2.6 シリーズには、新たな参照元動画生成モデルが加わり、既存の 4 つのモデルも包括的にアップグレードされています。Wan2.6-R2V は、外見と声の両方を含むキャラクター参照元動画をアップロードし、テキストプロンプトを使用して同じキャラクターが登場する鮮やかな新しいシーンを生成できます。人物、動物、物体、さらには複数の被写体を組み合わせた動画を作成でき、元の参照元の特徴的な外見と音声を保持します。
マルチモーダル参照元生成機能を搭載した Wan2.6-R2V は、映像と音声の一貫性を保ちながら、ユーザー自身や他の被写体を AI 生成シーンに挿入できる、中国初の参照元動画生成モデルです。これにより、ショートドラマ制作者のストーリーテリングの方法を変革し、制作プロセスを効率化します。
Wan2.6 シリーズには、テキストから動画生成モデル (Wan2.6-T2V)、画像から動画生成モデル (Wan2.6-I2V)、および 2 つの画像生成モデル (Wan2.6-image および Wan2.6-T2I) の機能強化も含まれています。
新しいインテリジェントなマルチショットストーリーテリング機能により、全体を通じて視覚的な一貫性を保ちながら、より豊かで表現力の高いナラティブを実現します。音響映像同期および音声から動画生成の機能向上により、よりリアルなシーンと豊かな効果音を実現します。
最大 15 秒の動画出力に対応し、クリエイターにストーリー展開のより大きな余地を提供します。インストラクション追従精度の向上と映像品質の改善と相まって、映画のようなプロフェッショナルグレードのコンテンツ制作を可能にします。
画像生成において、Wan2.6 シリーズは高度な論理推論機能を備えたテキストと画像の交互出力を可能にし、一貫性のあるビジュアルストーリーテリングをさらにサポートします。また、精密な芸術スタイル制御においても優れた能力を示し、驚くべき忠実度でリアルなポートレート生成および画像編集を実現します。長文の中国語および英語プロンプトを高度に理解することで、クリエイターはニュアンスや芸術的意図を捉えた高品質で表現力豊かなビジュアルコンテンツを制作できます。
ユーザーは、Alibaba Cloud の AI 開発プラットフォームである Model Studio および Wan の公式 ウェブサイト からモデルにアクセスおよびデプロイできます。これらのモデルは、Alibaba のフラッグシップ AI アプリケーションである Qwen App にも統合される予定です。
今年初めに初めて発表された Wan シリーズは、継続的なアップグレードを重ねており、AI 駆動のマルチメディア技術における Alibaba のリーダーシップと革新性を反映しています。
Alibaba Group について
Alibaba Group は、E コマースとクラウドコンピューティングに注力するグローバルテクノロジー企業です。デジタルおよび物流インフラ、効率化ツール、広範なマーケティングリーチを提供することで、マーチャント、ブランド、小売業者の販促、販売、消費者エンゲージメントを支援しています。また、業界をリードするクラウドインフラ、サービス、業務コラボレーション機能により、企業のデジタルトランスフォーメーションとビジネス成長をサポートしています。
Qwen(中国名:Tongyi Qianwen)は、Alibaba が開発した大規模言語モデルおよびマルチモーダル AI モデルのシリーズです。2023 年に登場し、オープンウェイトの Qwen モデルは HuggingFace および ModelScope を通じて世界中の開発者に公開されています。
