为什么需要补录
对白是整条声轨里唯一几乎不容噪声的元素。观众会原谅一声不对的脚步,不会原谅一句听不清的台词,所以任何清不干净的现场声都得替掉。常见原因都很平常:飞机、车流、大风、雨天棚、发电机、服装摩到领夹麦,或者一台没法隔开的摄影机。
第二个来源是剪辑台。台词会改,角色会改名,一个笑点在试片里没响,法务要求某个牌子不能被说出来。这些问题都没法回到现场解决,因为现场已经拆了。
第三个来源是表演。有时候这条技术上很干净,只是念法不对,导演想让这句轻一点、晚一点,或者换一种分量。
一次棚录怎么走
演员站在话筒前看自己的画面,传统做法是给三声 beep 数入这句。演员对着循环反复念,直到时间点和劲头都对上。现在更多是不靠 beep,让演员看着自己的嘴反复来,出来的念法通常更松、更像人。
真正的对位工作交给对白剪辑:把选中的那条放到位,对个别音节做拉伸和微移让口型成立,再把透视关系调成和周围现场声同一个声学空间。混响、EQ,以及所谓「过房间」(把这句放到一个真实空间里再录一遍)都属于这一步,目的是让一段棚里的干声在走廊里、在车里显得可信。
让补录听起来像现场
- 对上话筒和距离。 全景用挑杆录的声音和贴身领夹麦完全是两回事,拿一个替另一个,一听就出戏。
- 对上房间。 棚是死的,场景不是。必须把一部分反射加回去,用混响或者干脆放到真实空间里重录。
- 对上身体。 角色在走、在动、在喘,演员就得也在走在动在喘。站着模仿喘气基本不成立。
- 顺手替掉邻居。 一整段现场声里只补一句是最难的情况,因为进出补录的那两个接缝暴露在外。把前后几句一起补,往往比把一句融进去更容易。
AI 声音工具能接哪一段
这里真正有用的是两件能力:声音克隆能凭一段参考录音用某个演员的音色说出新句子;文本转语音能从零做出占位声或群杂声。两者都改变了小修小补的成本结构。
现在就能用的场合:
- 词级修补。 念错的人名、改掉的数字、改了名的地点。把生成的一个词接进一条真实的表演里,成功率是最高的。
- 占位对白。 演员还约不到,先把剪辑填满,让片子能拿去看。这一条本身就解掉一个排期瓶颈。
- 群杂与背景人声。 一条走廊里路过的群众,如果模型能给出二十个不同的声音,就没必要专门组一次群杂录音。
- 外语版本。 用主演的音色做本地化版本,这属于译制配音,不是同语言补录。
局限也很实在。模型处理平铺直叙的念法不错,处理一句话里持续保持的某种意图就吃力,尤其是叠着呼吸、憋着情绪、以及一声喊的尾巴。它给出的还是干净无房间的声音,所以每一句生成的对白仍然要走上面那套透视和房间处理。如果这句要对上银幕上已经存在的嘴,口型同步是另一道工序,不是声音模型顺手能解决的。
授权不是技术问题。使用演员的克隆声音由合约约束,在一些地区还由法律约束,这件事该写在合同里,而不是塞进声音部门的流程里。