镜头与机位

什么是跟拍镜头(tracking shot)?

又称 移动镜头, 随行镜头, tracking shot, follow shot

跟拍镜头是摄影机本身在空间里移动、跟着运动的主体走,让主体大致停在画面同一个位置、背景不断从旁边掠过的拍法。定义它的是机位的位移,不是摇摄,也不是变焦。

机位到底在做什么

跟拍镜头的核心是摄影机自己在空间里位移,这是物理层面的区别,不是风格上的说法。摇摄是机位钉在原地只转动,背景整体扫过,画面里没有远近层次差;一旦机位移动,近处的栏杆、车、柱子掠过的速度就明显快于远景,眼睛把这个速度差直接读成「我在跟着这个人走」。

用什么器材其实是次要的。轨道推车、斯坦尼康、稳定器、车载支架、无人机,甚至把手机绑在滑板上,出来的都是同一类镜头。真正区分「跟得住」和「跟得晃」的,是镜头到主体的距离有没有被控制住:正是这个恒定距离让主体在画面里大小不变,而背后的一切都在变。

四种值得记住的跟法

  • 背跟。 机位在主体后方、肩高。藏住脸,积累期待感,让观众按角色的节奏发现空间。
  • 前引。 机位在前方倒着走。你看的是反应而不是目的地,适合角色带着已经做好的决定走进来。
  • 侧跟。 机位与主体平行移动。这是「边走边说」的主力机位,视差最强,所以「在移动」这件事读起来最清楚。
  • 环绕。 主体基本站定,机位绕着转。慢转是亲密,快转是困住。

这个镜头买来的和付出的

跟拍是用银幕时间换连续性:中间没有切,观众就默认这段空间是真实的、连着的、正在被实时穿过。所以它天然适合登场、逃离,以及任何「地理关系本身有含义」的段落。

代价也是真的。一个移动镜头把你锁死在一条路线和一条表演上,剪辑台上再想调节奏就没有余地了。这段走路要是无聊,整个镜头就是无聊的,而且没有别的画面可切。

在 AI 视频里怎么写提示词

机位运动是视频模型里最不稳的一项,因为模型要从同一句话里把机位运动和主体运动分开。真正有效的写法:

  • 把机位单独写成一个子句,而且放在最前面。 camera tracks left alongside a man running 明显好过 a man running, tracking shot。主体写在前面时,模型通常只动人、机位不动。
  • 用画面相对方向,不用世界方向。 camera tracks rightcamera follows from behindcamera pushes in 都认;camera moves eastcamera goes around the corner跟他上楼 基本不认。
  • 明确写出什么必须保持不变constant distance, subject stays centered in frame。这一句能消掉大部分漂移。
  • 给近景放点有质感的东西:栏杆、路边车、廊柱、门洞。视差是这个运动能不能被看出来的关键,背景太空的时候,模型经常退化成一个慢慢的变焦,等于什么都没发生。

三种失败模式几乎每次都会遇到。一是机位往一边漂了一半又反向漂回来,原因是提示词里没有任何东西把方向钉死。二是人「滑」着往前走、腿不动,因为模型在整体平移这个人形而不是在做走路动画,补上 walking, full stride, feet visible 会好一些。三是背景在画面边缘被现编出来、越走越变形,运动越快越长就越明显。

这三种问题的通用解法都是更短、更慢。真需要一段长距离的移动,就分段生成,把上一段的末帧当作下一段的首帧接下去。

这个效果的提示词

一条能稳定出效果的起点。主体和场景可以换,技术性的那几句留着。

Lateral tracking shot, camera tracks right alongside a woman walking briskly down a rainy city street at dusk, constant distance, subject stays centered in frame, parked cars and railings passing in the near foreground, 35mm, shallow depth of field

试一下:跟拍镜头

打开生成器,参数已经预填好。

常见问题

跟拍镜头和推轨镜头(dolly shot)有什么区别?
推轨说的是器材(摄影机架在带轮的推车或轨道上),跟拍说的是关系:机位跟着一个主体走。跟着演员走的推轨镜头基本都是跟拍,但对着静物直推进去的推轨不是。
跟拍和摇摄(pan)是一回事吗?
不是。摇摄是机位不动、只转动镜头,背景整体扫过去,没有视差层次。跟拍是机位真的换了位置,近处物体掠过得比远处快,观众正是靠这个视差差异才觉得「我也在跟着走」。
一个跟拍镜头多长合适?
下限是视差得来得及被看见,通常至少两秒;上限是它还有存在的理由。院线片里的招牌长跟拍可以走好几分钟;在 AI 视频里,单段 3 到 6 秒是最稳的区间。
为什么 AI 视频模型很难拍好跟拍?
因为机位运动和主体运动要从同一句话里被拆出来。如果提示词先写主体,模型往往只让人动、机位停在原地。把机位运动单独写成一个子句并给出方向,能解决大半问题。
什么是背跟(follow shot)?
背跟是从主体背后跟的跟拍镜头,机位大致在肩高。它把脸藏起来,让观众和角色以同样的节奏发现前方的空间,所以特别适合「进入一个未知场所」。

相关术语