AI 首尾帧生成视频

给定第一帧和最后一帧,让 AI 补出中间的运动 —— 起点和终点都由你定,画面不会跑偏。

核心能力

起点和终点都由你定

上传两张图,中间的运动由模型补。比纯文字描述可控得多 —— 画面最终会落在哪里,你已经先定好了。

转场变得可控

上一个镜头的最后一帧作首帧、下一个镜头的第一帧作尾帧,中间那段过渡自然生成。

三十多个模型可选

大部分视频模型都支持首尾帧,运动的风格和幅度各有不同,同一组图可以换模型再试。

只有一张图也能用

只给首帧不给尾帧,就变成从这张图往后延续;两张都给才是精确的补间。

使用场景

让静帧活起来

让静帧活起来

一张满意的图作起点,指定它要变成什么样,中间的运动自动补上。

关键帧控制运动

关键帧控制运动

用两端锁住画面走向,避免模型自由发挥跑到你不想要的方向。

产品展示与揭示

产品展示与揭示

从合起到打开、从远到近,起止状态都是确定的产品图。

镜头之间的转场

镜头之间的转场

用前后两个镜头的边界帧生成过渡,接缝比硬切自然。

如何使用

01

打开 AI 首尾帧生成视频,上传第一帧。

02

上传最后一帧,再用一句话补充中间该发生什么。

03

选好时长和模型生成,然后下载或送进画布。

深入了解

两端定住,中间交给模型

从一张图生成视频有个常见的挫败感:模型动得很漂亮,但动到了你不想要的方向。你只给了起点,剩下的它自己决定。

首尾帧换了个思路:起点和终点都由你给,模型只负责补中间。画面最终落在哪里,在生成之前就已经确定了。

这个约束比任何提示词都强。想让产品从合起变成打开、镜头从远推到近、场景从白天转到夜晚 —— 与其描述这个过程,不如直接给出两端的样子。

两张图之间要有合理的关联

效果好不好,主要看你选的两端:

同一场景的两个状态最理想 —— 合起与打开、远与近、白天与夜晚。模型能理解这是同一个东西的变化,中间的过渡就顺。

完全无关的两张图会出问题 —— 模型只能硬凑一个过渡,中间往往出现变形或者突变。如果确实要从 A 跳到 B,那本来就该是一次硬切,不是补间。

只填首帧也行 —— 这时它退化成从这张图往后延续,效果接近图生视频。要精确控制落点才需要填尾帧。

什么时候该换个工具

  • 想看模型自己的想法 —— 用视频生成,只给一个起点或纯文字,让它自由发挥。
  • 要接长已有的片段 —— 用视频延长,它从视频的最后画面往下续,不需要你准备尾帧。
  • 要迁移一段具体的动作 —— 用运动控制,把参考视频的运动套到你的主体上。
  • 要人物说话口型对上 —— 用口型同步。

该怎么想这件事

首尾帧最适合「结果已经想清楚了」的时候。你脑子里已经有起止画面,需要的只是中间那段过渡 —— 这时给两端比写一段描述准得多。

反过来,方向还没定的时候用它反而费劲,因为你得先做出两张图。那种阶段用视频生成先试几条更快。

一个实用的组合:先在图像生成器里出两张关键画面,再拿到这里补间。这样整条镜头的起止都是你挑过的画面,而不是模型随机给的。

常见问题

和普通的图生视频有什么区别?+

图生视频只给起点,模型自由决定往哪儿动 —— 结果可能很好,也可能不是你想的。首尾帧多给了一个终点,等于把画面的走向框住了。想要确定的结果时用首尾帧,想看模型的想法时用图生视频。

两张图需要很像吗?+

需要有合理的关联。同一个场景的两个状态(合起/打开、远/近、白天/夜晚)效果最好。如果两张图完全无关,模型只能硬凑一个过渡,中间往往会出现变形或者突变。

中间的运动能控制吗?+

可以用文字补充,比如说明是推近、旋转还是形变。但首尾帧本身已经提供了最强的约束 —— 大部分情况下把两端选对,比反复调提示词有效。

只有一张图能用吗?+

可以,只填首帧就变成从这张图往后延续,效果接近图生视频。要精确控制落点才需要填尾帧。

更多模型