Wan AI

Wan 3.0

阿里的一体化视频渲染器 —— 单次生成 30 秒、原生音轨,一套参考同时吃图片、视频和人声。

无需订阅
积分永不过期
了解更多

一次充值积分,通用所有模型,想用再用。 · 按需充值,不存在月度清零。

Powered by Wan AI's API on ZOOOP

核心能力

单次生成 30 秒

一次请求就能出最长 30 秒的连续画面 —— 够装下一个完整叙事段落、一镜到底的空间穿行,或一整段口播广告,不用事后拼接。

一体化参考

最多 10 张参考图、5 段参考视频、5 条参考音频一次性提交。人脸、产品和声音在整段镜头里保持一致,不会拍一条飘一次。

首尾帧控制

锁住开场帧、需要时再锁住结束帧,中间的运动由模型补全 —— 想让镜头精确停在某一画面上,这是最稳的做法。

原生同步音轨

对白、环境音和配乐与画面在同一次生成里产出,成片自带立体声轨。关掉音轨也不会更便宜或更贵。

使用场景

一镜到底的 30 秒短片

一镜到底的 30 秒短片

一次生成覆盖完整叙事段落 —— 连续运镜、整段口播、产品穿行 —— 而不是三条素材回剪辑软件里对火柴。

整条镜头里的角色一致性

整条镜头里的角色一致性

丢进最多 10 张同一个人、同一套服装或同一件产品的参考图,第 2 秒和第 28 秒的脸是同一张。

带人声参考的对白戏

带人声参考的对白戏

参考音频和画面参考走同一次请求,对白场景出来的是你给的那把嗓子,而不是通用合成音。

结尾定帧的产品揭示

结尾定帧的产品揭示

从包装盒开场,停在主视觉那一帧。首尾帧把两端都钉死,接下一个镜头时能干净切走。

1440p 主视觉交付

1440p 主视觉交付

顶档输出 2560×1440,落地页头图和大屏播放用得上 —— 这些场景里 720p 母版会明显发虚。

用 Prime 档快速试错

用 Prime 档快速试错

Wan 3.0 Prime 是同一个模型的快车道,参数完全一样、排队优先 —— 适合还在定镜头的那几版。

如何选对模型

镜头要够长、而且要跟真实参考素材对得上时,选 Wan 3.0。其他需求换别的。

单次 30 秒、还要混合参考素材Wan 3.0
开放权重 + 指令式改片Wan 2.7
多模态参考 + 卡点音效Seedance 2.0
图片、视频、人声一次调用都进参考MiniMax H3
顶级画质与 4K 交付链路Veo 3.1
同族里最便宜的快速草稿Wan 2.6 Flash

如何使用

01

从本页进入 Wan 3.0,或在视频生成器里选它。

02

写提示词;镜头需要的话再加参考图、参考视频或参考音频。

03

选画面比例、最高 1440p 的分辨率,以及 2–30 秒的时长。

04

生成 —— 成片下载下来音轨已经对好。

深入了解

Wan 3.0 擅长什么,又不擅长什么

Wan 3.0 回答的是每个视频模型都在绕开的那个问题:镜头需要比几秒钟更长的时候怎么办? 主流旗舰单次生成大多卡在 5 到 15 秒之间,于是任何像"一场戏"的东西都得在剪辑软件里拼 —— 脸会飘、光会跳、房间在切点上换了形状。Wan 3.0 单次渲染最长 30 秒,这一个变化会重排你规划镜头的方式:一段穿过空间的连续运镜、一整条 30 秒口播、一次一镜到底的产品讲解,从剪辑问题变回提示词问题。

第二个差异点是一体化参考(All-in-One Reference)。参考系统通常只吃一种输入 —— 有的收图片,少数收一段视频,极少数收人声。Wan 3.0 在同一次请求里三种全收:最多 10 张参考图、5 段参考视频、5 条参考音频,参考视频与参考音频各自合计不超过 15 秒。实际效果是一整套品牌素材或一整份角色设定可以一次性喂进去,一致性能撑满整条片子,而不只是开头几秒。在 ZOOOP 上通道是自动切换的:带了任意参考就走参考生视频,留空就是同一个模型跑纯文生视频。

另外两项能力日常最常用。首尾帧控制让你钉死片段的两端、由模型补全中间的运动,这是让结尾精确落在某一帧、好干净切进下一个镜头的办法。原生同步音轨 —— 对白、环境音、配乐 —— 与画面在同一次生成里产出,成片自带立体声,且开关音轨不影响价格。

不擅长的地方它不开源。Wan 2.7 是 Apache 2.0、权重公开,Wan 3.0 没有公开权重、只有 API。流程里需要自部署或开源来源可查的话,这是硬门槛,答案仍然是 2.7。1440p 档是增强超分而非原生渲染 —— 确实是 2560×1440 的真文件、大屏交付够用,但有原生高分辨率通道的模型细节会更扎实。没有反向提示词,排除项只能靠正向描述解决。还有,图生视频这一路输出比例跟随输入首帧,该路径没有比例控制,所以要什么画幅请先把源图裁好再生成。

一个够用的判断标准:镜头够长、或者"能不能跟真实参考素材对上"直接决定这条能不能用时,选 Wan 3.0。要开放权重和指令式改片,用 Wan 2.7;要单镜头顶级画质,用 Veo 3.1;只是想快速出一堆草稿,用同族的 Wan 2.6 Flash。还在定镜头的阶段,用 Prime 档跑,定稿再切回标准档。

常见问题

Wan 3.0 一条片子最长多久?+

单次生成 2 到 30 秒。这是它和上一代最大的差别:以前要三条素材加一次剪辑才凑得出的 30 秒,现在是一次请求。

参考素材能放什么?+

同一次请求里最多 10 张参考图、5 段参考视频、5 条参考音频;参考视频合计不超过 15 秒,参考音频同样合计不超过 15 秒。只要带了任意一种参考就会自动走参考生视频通道,纯文字提示词则走文生视频。

Wan 3.0 像 Wan 2.7 那样开源吗?+

不开源。Wan 2.7 是 Apache 2.0 开放权重,Wan 3.0 只提供 API、没有公开权重。如果你的流程需要自部署或开源来源可查,还是用 Wan 2.7。

1440p 是原生渲染吗?+

480p、720p、1080p 三档是原生渲染;1440p 是在原生渲染基础上做增强超分得到的,成片确实是 2560×1440 的真文件,大屏交付够用,但和原生高分辨率渲染不是一回事。

Wan 3.0 和 Wan 3.0 Prime 有什么区别?+

同一个模型、同一套参数、同样的上限,Prime 走的是优先通道、出片更快,单价也更高。定稿用标准档,试错阶段等待成本高的时候用 Prime。

支持反向提示词吗?+

不支持。Wan 3.0 没有 negative prompt,想排除什么就在正向提示词里把想要的写清楚 —— 把机位、光线和运动讲具体,比试图"排除"有效得多。

更多模型

Wan AI
Wan V2.7
Wan AI
ByteDance
Seedance V2.0
ByteDance
MiniMax
MiniMax H3
MiniMax
Google
Veo 3.1
Google
OpenAI
GPT Image 2.5
OpenAI
OpenAI
GPT Image 2.0
OpenAI
ByteDance
Seedance V2.0 Fast
ByteDance
ByteDance
Seedance V1.5 Pro
ByteDance
ByteDance
Seedance V1.0 Pro
ByteDance
ByteDance
Seedance V1.0 Pro Fast
ByteDance
ByteDance
Seedance V1.0 Lite
ByteDance
ByteDance
Seedream 5.0 Pro
ByteDance
ByteDance
Seedream 5.0 Lite
ByteDance
ByteDance
Seedream 4.5
ByteDance
ByteDance
Seedream 4
ByteDance
ByteDance
Dreamactor V2
ByteDance
MiniMax
Minimax Music V2.6
MiniMax
MiniMax
Minimax Music V2
MiniMax
MiniMax
Speech-2.8-HD
MiniMax
MiniMax
Speech-2.8-Turbo
MiniMax
Kling AI
Kling O3
Kling AI
Kling AI
Kling V3
Kling AI
Kling AI
Kling V3 Pro
Kling AI
Kling AI
Kling V2.6 Pro
Kling AI
Kling AI
Kling V2.6
Kling AI
Kling AI
Kling Lipsync
Kling AI
Kling AI
Kling Avatar V2
Kling AI
Kling AI
Kling O1
Kling AI
Midjourney
Midjourney V8.2
Midjourney
Midjourney
Midjourney V8.1
Midjourney
Midjourney
Midjourney
Midjourney
Alibaba
Happy Horse V1.1
Alibaba
Alibaba
Happy Horse
Alibaba
xAI
Grok Imagine V1.5
xAI
xAI
Grok Imagine
xAI
xAI
xAI TTS
xAI
Google
Veo 3.1 Fast
Google
Google
Veo 3
Google
Google
Nano Banana Pro
Google
Google
Nano Banana 2
Google
Google
Nano Banana
Google
Google
Lyria 3 Pro
Google
Google
Lyria 3
Google
Google
Lyria2
Google
Google
Gemini 3.1 Flash TTS
Google
Wan AI
Wan V2.2
Wan AI
Wan AI
Wan V2.2 Turbo
Wan AI
Wan AI
Wan V2.5
Wan AI
Wan AI
Wan V2.6
Wan AI
Wan AI
Wan V2.6 Flash
Wan AI
Pixverse AI
Pixverse V6
Pixverse AI
Pixverse AI
Pixverse V5.5
Pixverse AI
Pixverse AI
Pixverse V5
Pixverse AI
Pixverse AI
Pixverse Lipsync
Pixverse AI
Vidu AI
Vidu Q3 Pro
Vidu AI
Vidu AI
Vidu Q3
Vidu AI
Vidu AI
Vidu Q3 Turbo
Vidu AI
Vidu AI
Vidu Q2 Pro
Vidu AI
Vidu AI
Vidu Q2 Turbo
Vidu AI
Luma AI
Luma Ray 2
Luma AI
Luma AI
Luma Ray 2 Flash
Luma AI
Flux AI
Flux 2 Pro
Flux AI
Flux AI
Flux 2
Flux AI
Flux AI
Flux 2 Flash
Flux AI
ElevenLabs
Multilingual V3
ElevenLabs
ElevenLabs
Multilingual V2
ElevenLabs
ElevenLabs
Sound Effects V2
ElevenLabs
Hailuo AI
Hailuo 2.3
Hailuo AI
Hailuo AI
Hailuo 2.3 Fast
Hailuo AI
Hailuo AI
Hailuo 02
Hailuo AI
Lightricks
LTX-2.3 Pro
Lightricks
Lightricks
LTX-2.3 Fast
Lightricks
Lightricks
LTX-2.3
Lightricks
Pika AI
Pika V2.2
Pika AI
Qwen
Qwen3-TTS
Qwen
Inworld
Inworld TTS
Inworld
Bilibili Index
Index TTS 2
Bilibili Index
Resemble AI
Chatterbox TTS Multilingual
Resemble AI
Open Source
ACE-Step
Open Source
Open Source
LUX TTS
Open Source
CassetteAI
Music Generator
CassetteAI
Recraft
Text to Vector V4.1
Recraft
Recraft
Text to Vector V4.1 Pro
Recraft
Recraft
Image to Vector
Recraft