Wan AI

Wan 3.0

阿里的一體化影片算圖引擎 —— 單次生成 30 秒、原生音軌,一套參考同時吃圖片、影片和人聲。

無需訂閱
積分永不過期
瞭解更多

一次充值積分,通用所有模型,想用再用。 · 按需充值,不存在月度清零。

Powered by Wan AI's API on ZOOOP

核心能力

單次生成 30 秒

一次請求就能產出最長 30 秒的連續畫面 —— 夠裝下一個完整敘事段落、一鏡到底的空間穿行,或一整段口播廣告,不必事後拼接。

一體化參考

最多 10 張參考圖、5 段參考影片、5 條參考音訊一次送出。人臉、產品和聲音在整段鏡頭裡保持一致,不會拍一條飄一次。

首尾影格控制

鎖住開場影格、需要時再鎖住結束影格,中間的運動由模型補完 —— 想讓鏡頭精準停在某一畫面上,這是最穩的做法。

原生同步音軌

對白、環境音和配樂與畫面在同一次生成裡產出,成片自帶立體聲軌。關掉音軌也不會更便宜或更貴。

使用場景

一鏡到底的 30 秒短片

一鏡到底的 30 秒短片

一次生成覆蓋完整敘事段落 —— 連續運鏡、整段口播、產品穿行 —— 而不是三條素材回剪輯軟體裡對火柴。

整條鏡頭裡的角色一致性

整條鏡頭裡的角色一致性

丟進最多 10 張同一個人、同一套服裝或同一件產品的參考圖,第 2 秒和第 28 秒的臉是同一張。

帶人聲參考的對白戲

帶人聲參考的對白戲

參考音訊和畫面參考走同一次請求,對白場景出來的是你給的那把嗓子,而不是通用合成音。

結尾定影格的產品揭示

結尾定影格的產品揭示

從包裝盒開場,停在主視覺那一格。首尾影格把兩端都釘死,接下一個鏡頭時能乾淨切走。

1440p 主視覺交付

1440p 主視覺交付

頂檔輸出 2560×1440,到達頁主圖和大螢幕播放用得上 —— 這些場景裡 720p 母版會明顯發虛。

用 Prime 檔快速試錯

用 Prime 檔快速試錯

Wan 3.0 Prime 是同一個模型的快車道,參數完全一樣、排隊優先 —— 適合還在定鏡頭的那幾版。

如何選對模型

鏡頭要夠長、而且要跟真實參考素材對得上時,選 Wan 3.0。其他需求換別的。

單次 30 秒、還要混合參考素材Wan 3.0
開放權重 + 指令式改片Wan 2.7
多模態參考 + 卡點音效Seedance 2.0
圖片、影片、人聲一次呼叫都進參考MiniMax H3
頂級畫質與 4K 交付鏈路Veo 3.1
同族裡最便宜的快速草稿Wan 2.6 Flash

如何使用

01

從本頁進入 Wan 3.0,或在影片產生器裡選它。

02

寫提示詞;鏡頭需要的話再加參考圖、參考影片或參考音訊。

03

選畫面比例、最高 1440p 的解析度,以及 2–30 秒的長度。

04

生成 —— 成片下載下來音軌已經對好。

深入瞭解

Wan 3.0 擅長什麼,又不擅長什麼

Wan 3.0 回答的是每個影片模型都在繞開的那個問題:鏡頭需要比幾秒鐘更長的時候怎麼辦? 主流旗艦單次生成大多卡在 5 到 15 秒之間,於是任何像「一場戲」的東西都得在剪輯軟體裡拼 —— 臉會飄、光會跳、房間在切點上換了形狀。Wan 3.0 單次算圖最長 30 秒,這一個變化會重排你規劃鏡頭的方式:一段穿過空間的連續運鏡、一整條 30 秒口播、一次一鏡到底的產品講解,從剪輯問題變回提示詞問題。

第二個差異點是一體化參考(All-in-One Reference)。參考系統通常只吃一種輸入 —— 有的收圖片,少數收一段影片,極少數收人聲。Wan 3.0 在同一次請求裡三種全收:最多 10 張參考圖、5 段參考影片、5 條參考音訊,參考影片與參考音訊各自合計不超過 15 秒。實際效果是一整套品牌素材或一整份角色設定可以一次餵進去,一致性能撐滿整條片子,而不只是開頭幾秒。在 ZOOOP 上通道是自動切換的:帶了任一參考就走參考生影片,留空就是同一個模型跑純文生影片。

另外兩項能力日常最常用。首尾影格控制讓你釘死片段的兩端、由模型補完中間的運動,這是讓結尾精準落在某一格、好乾淨切進下一個鏡頭的辦法。原生同步音軌 —— 對白、環境音、配樂 —— 與畫面在同一次生成裡產出,成片自帶立體聲,且開關音軌不影響價格。

不擅長的地方它不開源。Wan 2.7 是 Apache 2.0、權重公開,Wan 3.0 沒有公開權重、只有 API。流程裡需要自架或開源來源可查的話,這是硬門檻,答案仍然是 2.7。1440p 檔是增強超解析度而非原生算圖 —— 確實是 2560×1440 的真檔案、大螢幕交付夠用,但有原生高解析度通道的模型細節會更扎實。沒有反向提示詞,排除項只能靠正向描述解決。還有,圖生影片這一路輸出比例跟隨輸入首影格,該路徑沒有比例控制,所以要什麼畫幅請先把來源圖裁好再生成。

一個夠用的判斷標準:鏡頭夠長、或者「能不能跟真實參考素材對上」直接決定這條能不能用時,選 Wan 3.0。要開放權重和指令式改片,用 Wan 2.7;要單鏡頭頂級畫質,用 Veo 3.1;只是想快速出一堆草稿,用同族的 Wan 2.6 Flash。還在定鏡頭的階段,用 Prime 檔跑,定稿再切回標準檔。

常見問題

Wan 3.0 一條片子最長多久?+

單次生成 2 到 30 秒。這是它和上一代最大的差別:以前要三條素材加一次剪輯才湊得出的 30 秒,現在是一次請求。

參考素材能放什麼?+

同一次請求裡最多 10 張參考圖、5 段參考影片、5 條參考音訊;參考影片合計不超過 15 秒,參考音訊同樣合計不超過 15 秒。只要帶了任一種參考就會自動走參考生影片通道,純文字提示詞則走文生影片。

Wan 3.0 像 Wan 2.7 那樣開源嗎?+

不開源。Wan 2.7 是 Apache 2.0 開放權重,Wan 3.0 只提供 API、沒有公開權重。如果你的流程需要自架或開源來源可查,還是用 Wan 2.7。

1440p 是原生算圖嗎?+

480p、720p、1080p 三檔是原生算圖;1440p 是在原生算圖基礎上做增強超解析度得到的,成片確實是 2560×1440 的真檔案,大螢幕交付夠用,但和原生高解析度算圖不是一回事。

Wan 3.0 和 Wan 3.0 Prime 有什麼差別?+

同一個模型、同一套參數、同樣的上限,Prime 走的是優先通道、出片更快,單價也更高。定稿用標準檔,試錯階段等待成本高的時候用 Prime。

支援反向提示詞嗎?+

不支援。Wan 3.0 沒有 negative prompt,想排除什麼就在正向提示詞裡把想要的寫清楚 —— 把機位、光線和運動講具體,比試圖「排除」有效得多。

更多模型

Wan AI
Wan V2.7
Wan AI
ByteDance
Seedance V2.0
ByteDance
MiniMax
MiniMax H3
MiniMax
Google
Veo 3.1
Google
OpenAI
GPT Image 2.5
OpenAI
OpenAI
GPT Image 2.0
OpenAI
ByteDance
Seedance V2.0 Fast
ByteDance
ByteDance
Seedance V1.5 Pro
ByteDance
ByteDance
Seedance V1.0 Pro
ByteDance
ByteDance
Seedance V1.0 Pro Fast
ByteDance
ByteDance
Seedance V1.0 Lite
ByteDance
ByteDance
Seedream 5.0 Pro
ByteDance
ByteDance
Seedream 5.0 Lite
ByteDance
ByteDance
Seedream 4.5
ByteDance
ByteDance
Seedream 4
ByteDance
ByteDance
Dreamactor V2
ByteDance
MiniMax
Minimax Music V2.6
MiniMax
MiniMax
Minimax Music V2
MiniMax
MiniMax
Speech-2.8-HD
MiniMax
MiniMax
Speech-2.8-Turbo
MiniMax
Kling AI
Kling O3
Kling AI
Kling AI
Kling V3
Kling AI
Kling AI
Kling V3 Pro
Kling AI
Kling AI
Kling V2.6 Pro
Kling AI
Kling AI
Kling V2.6
Kling AI
Kling AI
Kling Lipsync
Kling AI
Kling AI
Kling Avatar V2
Kling AI
Kling AI
Kling O1
Kling AI
Midjourney
Midjourney V8.2
Midjourney
Midjourney
Midjourney V8.1
Midjourney
Midjourney
Midjourney
Midjourney
Alibaba
Happy Horse V1.1
Alibaba
Alibaba
Happy Horse
Alibaba
xAI
Grok Imagine V1.5
xAI
xAI
Grok Imagine
xAI
xAI
xAI TTS
xAI
Google
Veo 3.1 Fast
Google
Google
Veo 3
Google
Google
Nano Banana Pro
Google
Google
Nano Banana 2
Google
Google
Nano Banana
Google
Google
Lyria 3 Pro
Google
Google
Lyria 3
Google
Google
Lyria2
Google
Google
Gemini 3.1 Flash TTS
Google
Wan AI
Wan V2.2
Wan AI
Wan AI
Wan V2.2 Turbo
Wan AI
Wan AI
Wan V2.5
Wan AI
Wan AI
Wan V2.6
Wan AI
Wan AI
Wan V2.6 Flash
Wan AI
Pixverse AI
Pixverse V6
Pixverse AI
Pixverse AI
Pixverse V5.5
Pixverse AI
Pixverse AI
Pixverse V5
Pixverse AI
Pixverse AI
Pixverse Lipsync
Pixverse AI
Vidu AI
Vidu Q3 Pro
Vidu AI
Vidu AI
Vidu Q3
Vidu AI
Vidu AI
Vidu Q3 Turbo
Vidu AI
Vidu AI
Vidu Q2 Pro
Vidu AI
Vidu AI
Vidu Q2 Turbo
Vidu AI
Luma AI
Luma Ray 2
Luma AI
Luma AI
Luma Ray 2 Flash
Luma AI
Flux AI
Flux 2 Pro
Flux AI
Flux AI
Flux 2
Flux AI
Flux AI
Flux 2 Flash
Flux AI
ElevenLabs
Multilingual V3
ElevenLabs
ElevenLabs
Multilingual V2
ElevenLabs
ElevenLabs
Sound Effects V2
ElevenLabs
Hailuo AI
Hailuo 2.3
Hailuo AI
Hailuo AI
Hailuo 2.3 Fast
Hailuo AI
Hailuo AI
Hailuo 02
Hailuo AI
Lightricks
LTX-2.3 Pro
Lightricks
Lightricks
LTX-2.3 Fast
Lightricks
Lightricks
LTX-2.3
Lightricks
Pika AI
Pika V2.2
Pika AI
Qwen
Qwen3-TTS
Qwen
Inworld
Inworld TTS
Inworld
Bilibili Index
Index TTS 2
Bilibili Index
Resemble AI
Chatterbox TTS Multilingual
Resemble AI
Open Source
ACE-Step
Open Source
Open Source
LUX TTS
Open Source
CassetteAI
Music Generator
CassetteAI
Recraft
Text to Vector V4.1
Recraft
Recraft
Text to Vector V4.1 Pro
Recraft
Recraft
Image to Vector
Recraft