拟音到底包含什么
成片里几乎所有细碎的声音都是拍完之后补的。现场录音师的任务是对白,话筒指着脸,其它声音都是副产品:脚步偏轴、衣服被埋掉、道具的响声被机器盖住。拟音就是把这一层重新演一遍,做成干净、独立的素材,交给混音去塑形。
一次拟音通常拆成三遍走,知道这个分法有用,因为它决定了你该点什么单:
- 脚步。 每一步都要踩在正确的材质上,轻重和步态跟着画面里的演员。这一遍决定了一个角色「有多重」。
- 动作。 衣服摩擦、外套挪动、手掌划过桌面。观众不会有意识地听见这一层,但缺了它,演员就像贴在背景上,而不是站在场景里。
- 道具与特定音。 钥匙、杯子、门锁、纸张、手机放下。凡是有明确起点、必须卡在某一帧的声音都归这里。
一次拟音棚的流程
拟音棚是一屋子材质:碎石坑、沙坑、木板、瓷砖、浴缸,还有一扇装在架子上的门。拟音师看着剪好的画面实时表演,录音师同步录,一条线索一般录几遍。之后由音效剪辑把素材对到画面上,逐帧微调。
之所以坚持「表演」而不是「拼贴」,关键在于意图。演员疲了,第二步就会拖一点;有人怕吵醒别人,杯子落下就会轻一点。这些东西没法靠把文件拖到时间线上得到。
和素材库怎么分工
素材库赢在那些没法在棚里演的东西:车流、风雨、飞机、枪械。拟音赢在一切由身体产生的声音,因为身体有节奏,而一个素材文件并不知道你的演员在干什么。另一个不常被提的好处是干净:自己演出来的声音版权是自己的,录得干、透视关系也是你要的那一种。
AI 生成音效能替到哪一步
文本生成音频这几年在「短的单个事件」和「连续质感」上已经相当能用。要一段湿碎石上的踩踏、瓷杯落在木桌上、布料挪动的声音,出来的东西可以直接进轨。这确实覆盖了拟音工作里的一部分,而且比翻素材库快得多。
它替不了的是对位。模型不知道你的演员脚跟落在第几帧,所以每个事件还是得你自己摆。想让生成素材真的能用,有两个习惯:
- 要单一事件、干声、近距离。带混响、带音乐的文件在分层混音里基本是废的。
- 同一个动作多生成几条变体。真实脚步不会两步完全一样,一条文件循环使用是让场景瞬间变假的最快方式。
如果直接从视频出音效而不是从文字描述出,时间点会更接近,因为模型看见了动作本身。但它仍然需要有人把事件推到准确的位置,也仍然需要把脚步那一遍当成表演来对待,而不是当成填空。