
ワンテイクの 30 秒ストーリー
1 回の生成で物語の区切りをまるごとカバーします。連続したカメラワーク、ナレーション 1 本、ウォークスルー —— 編集ソフトで 3 クリップを合わせる作業が不要になります。
Alibaba のオールインワン動画レンダラー —— 1 回の生成で 30 秒、ネイティブ音声、画像・動画・声を同時に受け取る 1 つの参照セット。
クレジットを一度支払う-ZOOOPのすべてのモデルで使用してください。 · 必要に応じて補充してください。毎月の負担はありません。
Powered by Wan AI's API on ZOOOP
1 リクエストで最長 30 秒の連続映像を出力します。1 つの物語の区切り、ワンテイクのウォークスルー、ナレーション広告 1 本分が、後からのつなぎ合わせなしで収まります。
参照画像は最大 10 枚、参照クリップ 5 本、参照音声 5 本を同じリクエストにまとめて渡せます。顔・製品・声がカットごとにブレず、ショット全体で揃います。
開始フレームを固定し、必要なら終了フレームも固定すると、その間の動きをモデルが埋めます。狙ったフレームで終わらせる最も確実な方法です。
セリフ・環境音・音楽を映像と同じパスで生成し、完成ファイルにステレオ音声として付きます。音声をオフにしても料金は変わりません。

1 回の生成で物語の区切りをまるごとカバーします。連続したカメラワーク、ナレーション 1 本、ウォークスルー —— 編集ソフトで 3 クリップを合わせる作業が不要になります。

同じ人物・衣装・製品の参照画像を最大 10 枚渡せば、2 秒目と 28 秒目で同じ顔が保たれます。

参照音声も映像参照と同じリクエストに入るため、会話シーンは汎用的な合成音声ではなく、渡した声で仕上がります。

パッケージから始めてヒーローフレームで止める。開始/終了フレーム制御が両端を固定するので、次のカットへきれいにつながります。

最上位ティアは 2560×1440 で出力します。ランディングページのヒーローや大画面再生など、720p マスターでは明らかに甘くなる用途向けです。

Wan 3.0 Prime は同じモデルの優先レーンです。操作は同一で生成が優先されるため、ショットを決めきる前の検討パスに向いています。
ショットを長く回す必要があり、実際の参照素材と合っていることが求められるときは Wan 3.0 です。目的が違えば別のモデルへ。
このページから Wan 3.0 を開くか、動画ジェネレーターで選択します。
プロンプトを書き、必要なら参照画像・参照クリップ・参照音声を追加します。
アスペクト比、最大 1440p の解像度、2〜30 秒の長さを選びます。
生成します。完成したクリップは音声が同期済みの状態で届きます。
Wan 3.0 は、どの動画モデルも避けてきた問いに答えます。ショットが数秒より長く必要になったらどうするのか? 主要なフラッグシップは 1 回の生成が 5〜15 秒で頭打ちになるため、「シーン」らしきものはすべて編集ソフトで組み立てることになります。そしてカットのたびに顔がブレ、光が変わり、部屋の形まで変わってしまう。Wan 3.0 は 1 パスで最長 30 秒をレンダリングし、この 1 点だけでショットの組み立て方が変わります。空間を貫く連続したカメラワーク、30 秒のナレーション広告、ワンテイクの製品ウォークスルー —— これらは編集の問題ではなく、プロンプトの問題に戻ります。
2 つ目の特徴がオールインワン参照です。参照の仕組みはたいてい 1 種類の入力しか受け付けません。画像だけ、まれにクリップ 1 本、ごく一部が声。Wan 3.0 は同じリクエストで 3 種類すべてを受け取ります。参照画像 10 枚、参照クリップ 5 本、参照音声 5 本、参照動画と参照音声はそれぞれ合計 15 秒まで。実務上は、ブランドキット一式やキャラクターシート一式をまとめて渡せるということであり、一貫性が冒頭の数秒ではなくクリップ全体で保たれます。ZOOOP では振り分けが自動で、参照を付ければ参照パイプライン、空のままなら同じモデルが text-to-video を実行します。
日常的に効く機能があと 2 つ。開始/終了フレーム制御はクリップの両端を固定して間の動きをモデルに埋めさせる仕組みで、次のカットへきれいにつながる終わり方を狙えます。そしてネイティブ同期音声 —— セリフ、環境音、音楽 —— は映像と同じパスで生成されてステレオトラックとしてファイルに付き、音声のオン/オフで料金は変わりません。
弱いところ。オープンウェイトではありません。 Wan 2.7 は Apache 2.0 で重みが公開されましたが、Wan 3.0 は公開なし、API のみです。セルフホストやオープンな来歴が必要なパイプラインでは、そこが決定的で、答えは 2.7 のままです。1440p ティアはネイティブレンダリングではなく強化アップスケールで、実ファイルは 2560×1440、大画面納品には十分ですが、ネイティブの高解像度パスを持つモデルのほうがディテールは残ります。ネガティブプロンプトがないため、除外は「欲しいものを書く」で処理する必要があります。さらに image-to-video では出力が入力フレームのアスペクト比に従うため、そのパスに比率指定はなく、生成前に元画像を切り抜いておく必要があります。
妥当な使い分けはこうです。ショットが長いとき、あるいは実際の参照素材と合っているかどうかがテイクの可否を決めるときに Wan 3.0 を選ぶ。 オープンな重みと指示ベースの編集なら Wan 2.7。単発ショットの最高画質なら Veo 3.1。同系列で使い捨てのドラフトを量産するなら Wan 2.6 Flash。ショットの内容をまだ決めきれていない段階では Prime ティアで回し、最終レンダーで標準ティアに戻してください。
1 回の生成で 2〜30 秒です。これが前世代との最大の違いで、以前は 3 クリップと編集が必要だった 30 秒が、いまは 1 リクエストで済みます。
同じリクエストに参照画像 10 枚、参照クリップ 5 本、参照音声 5 本まで入れられます。参照クリップと参照音声はそれぞれ合計 15 秒までです。参照を 1 つでも付けると自動的に参照パイプラインに振り分けられ、テキストのみのプロンプトなら text-to-video が実行されます。
いいえ。Wan 2.7 は Apache 2.0 で重みが公開されましたが、Wan 3.0 は API のみで重みの公開はありません。セルフホストやオープンな来歴が必要なら、引き続き Wan 2.7 を使ってください。
480p・720p・1080p はネイティブレンダリングです。1440p はネイティブレンダリングに対する強化アップスケールで、実際に 2560×1440 のファイルが得られ大画面納品には十分ですが、ネイティブの高解像度パスとは別物です。
モデルもパラメーターも上限も同じで、Prime は優先レーンで実行されるぶん速く、料金も高くなります。最終レンダーは標準ティア、待ち時間のコストが高い試行段階では Prime を使ってください。
対応していません。Wan 3.0 にネガティブプロンプトはないので、除外したいものではなく欲しいものをプロンプトに書いてください。カメラアングル・ライティング・動きを具体的に書くほうが効果があります。
最初と最後のフレームビデオテキストとビデオへの参照
最初と最後のフレームビデオテキストとビデオへの参照
最初と最後のフレームビデオテキストとビデオへの参照
最初と最後のフレームビデオテキストとビデオへの参照
最初と最後のフレームビデオテキストとビデオへの参照
最初と最後のフレームビデオテキストとビデオへの参照
Wan 3.0
Prompt*
画像
ビデオ
オーディオ
アスペクト比*
解決策*
デュレーション*