它干的三件活
把这类素材叫作「补充」其实低估了它,因为只用主素材拼起来的片子通常是不成立的。B 卷在做具体的结构性工作,而知道你需要哪一件活,决定了该拍什么。
图解。 有人在描述一个地方、一道工序或者一件东西,你把它拍出来。这是最显然的用途,也是最容易过量供给的:把每个名词都字面图解一遍,会很快让人疲劳。
遮盖。 说话人头像里有停顿、重复和口误,你想删掉它们,而删掉就会产生跳切。在接缝处铺一段补充镜头能把它完全藏起来,这就是为什么访谈剪辑很大程度上就是「决定在哪里切出去」这门手艺。
节奏。 一个毫无空隙的段落读起来是不留余地的。几秒钟安静的东西,能让一个观点落地之后下一个才到来 —— 而这是最被低估的一种用途。
拍什么,拍多少
数量上的经验和直觉相反:按成片长度的三到五倍来准备。原因是在剪辑存在之前,你不可能知道哪些时刻需要被遮住,而到那时拍摄已经结束了。
让一个镜头「可用」的东西,不是它有多好看。
- 长到可以修剪。 一个连续构想拍五到十秒。太短的片段只能落在一个位置上。
- 固定或者极慢。 锁死的镜头哪里都能剪进去,一个甩摇几乎哪里都进不去。
- 主体单一。 一个画框里同时发生三件事,它就只属于剪辑里某一个特定时刻。
- 对时间保持含糊。 带钟表、屏幕,或者有明显光线变化的东西,都会限制它能去哪儿。
- 没有嘴部动作。 可见的说话会把镜头绑死在特定对白上,让它没法当遮盖用。
用生成的方式补齐
这是生成视频真正合适、而不是退而求其次的最清楚的场合之一,理由是结构性的:这类镜头短、不含对白、不需要和同一空间的另一个机位对上,而且其中很大一部分是纯质感而非叙事。生成视频的所有弱点 —— 连续性、长镜头、脸、说话 —— 在这份需求里一个都不出现。
实操上:把镜头写成一个静止的构想,而不是一个事件:steam rising from a coffee cup on a workshop bench。加上让它读起来像被拍摄而不是被画出来的光学语言,因为这才是要和你真实素材对上的部分:shallow depth of field、50mm at f/2、morning light through a dirty window。
明确要求静止。 Slow static shot 能阻止模型自己发明一个你不想要的运镜,而固定片段在剪辑里本来就更好用。
除非需要,否则排除人。 no people 把生成视频最不擅长的两样东西 —— 脸和手 —— 从一个几乎不需要它们的镜头里移走。
最后,生成变体而不是打磨一条。 同一个构想在略微不同的构图上出四条,能给剪辑师选择,而这正是这类素材存在的意义。