它对注意力做了什么
每个镜头都在告诉观众该看哪里,通常靠构图、运动或者光。变焦点是用镜头来说这件事,而且它说的是「转移」,不是「宣告」。先是这个东西清楚,然后变成另一个东西清楚,眼睛会跟着走,因为清晰度是画面里最强的注意力线索。
这种转移携带的信息是切换镜头给不了的。切一刀说的是「现在看这里」;拉焦说的是「这两个东西在同一个空间里,而它们的关系刚刚变了」。所以它是这些场合的常规工具:角色察觉到身后有东西、某个道具突然变得重要、对话背景里藏着的偷听者被揭示出来。
方向也有讲究。从前景拉到后景,通常像发现或者不安,因为你被指出了一个此前没注意到的东西;从后景拉回前景,更像一个结论落地,或者注意力被拽回眼前这个人身上。
需要的光学条件
三个条件必须同时成立,缺一个这次拉焦就根本看不出来。
- 浅景深。 焦段更长、光圈更大,或者两者兼有。大景深从定义上就让这个手法无法存在。
- 纵深上的分离。 两个主体的距离必须真的不同。并排站的两个人之间没法拉焦。
- 有能读出「清晰」的东西。 纹理、边缘、印刷字、眼睛。一面平涂的墙即使对焦真的变了也看不出来。
- 现场还有第四个条件:一个带着标好距离的跟焦员。f/1.4 下容错只有几厘米,所以这是个依赖排练的镜头,不是可以临场即兴的镜头。
几种值得知道的变体
急拉在几帧之内走完同样的距离,读起来是冲击。三层拉焦先拉到中间的主体再继续往后,很炫但很难做干净。**分离滤镜(split diopter)**干脆不拉,让两个纵深同时清晰 —— 当你要的是「同时」而不是「转移」时,它才是正确答案。
在 AI 视频里怎么写提示词
这是视频模型里比较难拿到的一类效果,因为模型没有镜头也没有对焦距离,它是在按统计规律生成「对焦变化看起来是什么样」。这意味着提示词必须替光学把几何关系交代清楚。
- 两个主体和两个距离都点名:
a ringing telephone sharp in the foreground, a woman blurred in the doorway behind it。只写一个主体,对焦平面就没有可去的地方。 - 方向和时机写在同一个子句里:
focus shifts from the telephone to the woman halfway through the shot。changing focus、梦幻虚焦这类含糊说法,换来的基本都是整体模糊。 - 写上镜头语言,因为它和训练数据里的画面质感高度相关:
85mm at f/1.8, very shallow depth of field, bokeh。 - 锁死机位。 加一句
static camera,能避免模型用推轨或变焦来「代替」拉焦,这是它最常见的误解方式。
按出现频率排列的失败模式:整个画面先软再重新变清楚,但两个主体谁都没有被单独隔离出来;模型改成缓慢变焦;后景那个主体在拉焦过程中换了身份或者换了衣服,因为它从来没有清晰到被确定下来;以及第一帧就已经拉完了,镜头没有「之前」的状态。
有两个真的靠得住的绕行方案。一是用完全相同的提示词生成两条、分别停在两个对焦状态上,再把两条素材用 12 到 20 帧交叉叠化,因为两头都是稳定的,出来的拉焦非常干净。二是整段都按大景深生成,模糊在后期用遮罩加上去,速度和幅度完全可控,通常比反复重摇一条变焦点更省时间。