動画生成AI「Wan3.0」が正式リリースされる、最大30秒生成可能で「製品企画スライドを読み込ませてPV作成」など情報分析精度が大幅に向上

AlibabaがAI動画生成モデル「Wan3.0」の一般提供を8月24日に開始しました。Wan3.0は文章や画像に加えて文書・スプレッドシート・スライド・ウェブページなども読み込み可能で、1回の生成で最大30秒の動画を作成できます。
Wan 3.0 Video Generation · Cinematic Audio-Visual · Alibaba Cloud Model Studio
https://modelstudio.console.alibabacloud.com/model-releases/wan3.0-video
Wan3.0: 30-Second AI Video Generation from Any Input | Model Studio Blog
https://modelstudio.alibabacloud.com/intl/blog/wan3-ai-video-generation-model/
This is Wan3.0.
— Wan (@Alibaba_Wan) 2026年8月24日
Simple Input. Smart Creation. Where Imagination Meets Reality.
Wan3.0 is now generally available.
🎉 Launch offer: Get 30% off Wan3.0 (Standard) on Alibaba Cloud Model Studio and Qwen Cloud from August 23 to September 23. pic.twitter.com/GVogLtvzjK
AI動画生成モデルでは数秒程度の短い映像を生成するものが主流で、Alibabaの従来モデル「Wan2.7-Video」も1回に生成できる動画は最大15秒でした。商品の紹介や物語のある広告では複数の映像をつなぐケースも多く、場面をまたいで人物の顔や服装、背景、小道具などをそろえることが課題になります。
Wan3.0では1回に生成できる動画を従来の2倍となる最大30秒まで延長し、人物の動きや会話、カメラワークを含む一連の場面をまとめて生成しやすくなっています。入力した指示の内容に応じて動画の長さを提案する機能も備えているほか、生成済みの動画から続きを作る動画延長機能も利用できるとのこと。
さらに動画用の素材を準備する作業を減らすため、Wan3.0はオフィス文書を直接読み込めるようになりました。対応形式にはdoc・xls・ppt・pdf・txt・key・pages・numbers・mdなどが含まれるほか、ウェブページのリンクも入力できるとのこと。1回のリクエストにつき1ファイルまたは1リンクを読み込めて、ファイルサイズは最大100MB、文書は最大50ページまでとなっています。

例えば商品説明のスライドから広告動画を作ったり、研修資料を教材動画に変換したりできます。スプレッドシートに入った数値を動きのあるグラフとして映像化することも可能で、報告書からナレーション付きの動画を作る用途も想定されています。普段使っている資料を動画制作の出発点にできるというわけ。

Wan3.0は文章・画像・動画・音声など複数の素材を組み合わせて参照素材として使用できます。参照素材を基に動画を生成する機能では、人物の顔や髪形、服装に加えて小道具やロゴ、空間の位置関係、映像全体の作風などを場面をまたいで維持しやすくしたとAlibabaは説明しています。
また、Wan2.7で導入された動画編集機能はWan3.0にも引き継がれています。映像の見た目や展開、セリフなどを指定して修正できる仕組みとのこと。Alibabaは音声の質感や画面内に表示する文字の正確さについて今後改善を進めると述べています。
Wan3.0はAlibaba Cloud Model StudioやQwen Cloudから利用可能。Standard版のAPI料金は生成した動画1秒当たり480pが0.05ドル(約8円)、720pが0.10ドル(約16円)、1080pが0.20ドル(約32円)で、通常料金では30秒の1080p動画が6ドル(約956円)となる計算です。なお、リリースキャンペーンとして2026年9月23日までStandard版が30%割引されるとのこと。

また、生成速度を向上した「Prime」版も用意されており、生成した動画1秒当たり480pが0.068ドル(約11円)、720pが0.14ドル(約22円)、1080pが0.28ドル(約45円)で利用可能です。

AlibabaはWan3.0について映画や短編ドラマ、広告、マーケティング、観光PRなどでの利用に加えて、自動運転やロボット向けのシミュレーション映像を作る用途も想定しているとのこと。Alibabaは今後も音声や画面内テキストの精度を改善するとともに、より豊富な情報を理解して物理世界を再現できる方向へWanシリーズを発展させていく考えを示しています。
・関連記事
画像・動画・音声の生成AIモデルを条件に合わせて自動で選ぶ「Runway Media Router」が登場 - GIGAZINE
NVIDIAが1分間の動画を生成できるAI「SANA-WM」を発表、カメラ移動を精密に制御可能 - GIGAZINE
動画生成AI「Runway」がChatGPTやClaudeのチャット内で利用可能に、チャットで参考画像やアイデアを入力して動画化できる - GIGAZINE
動画生成AI「FLUX 3 Video」が一般公開される、1080p・20秒の動画を生成可能で近日中にオープンモデルも公開予定 - GIGAZINE
リアルタイム動画生成AI「LongLive-2.0」をNVIDIAが公開、FP4量子化を想定した学習により軽量かつ高品質な生成を実現 - GIGAZINE
・関連コンテンツ
in AI, Posted by log1d_ts
You can read the machine translated English article The video generation AI 'Wan3.0' has bee….







