在世界之内还是之外
一条成片声轨上的每个声音,都落在同一个问题的某一侧:这场戏里的角色能听到它吗?有声源声音是「能」的那一侧。它存在于影片的世界里,在画框内外某处有一个物理声源,也因此要遵守物理规律。
「不能」的那一侧只对观众说话。配乐、旁白、片名上刮过去的一道风声、揭示瞬间砸下来的低频,全都在故事世界之外。角色们过完一生也不会注意到它们。
各自的例子
故事世界之内:
- 角色之间的对白
- 脚步、门、衣料、餐具,整个拟音层
- 车流、雨、风、房间里空调的底噪
- 台上的乐队、收音机、响起的手机、背景里开着的电视
之外:
- 管弦或电子配乐
- 画外旁白与内心独白
- 剪辑性音效:上扬音、刺音、转场声
- 一首没有画内来源、直接铺在整段上的歌
中间地带才是有意思的地方
有三种情况故意卡在两者之间,声音设计最有表现力的活儿都发生在这里。
场景音乐变成配乐。 一段音乐从画内的音箱里起,随后房间的声学关系褪去,音乐铺满整个声场。观众会感到这场戏从字面的空间里被抬了起来。反过来做也一样有效,把配乐收进一台车载收音机,往往还更有喜剧感。
内在有声源声音。 角色的心跳、爆炸后的耳鸣、记忆里的一句话。角色听得到,别人听不到,所以它在故事世界之内,但只对一个人成立。现代电影里几乎所有主观段落都跑在这个机制上。
带评论的声音。 技术上有出处、但被夸张到远超写实的音效,比如等人时那只越走越响、响得不合物理的钟。它留在世界之内,同时开始承担配乐的功能。
分开生成音频时,这个区分为什么关键
AI 音频工具给你的是三条彼此独立的流:音效、音乐、语音。它们出来都是干净、无房间、满音量的,这对配乐正好合适,对任何要「存在于房间里」的声音正好相反。
如果一条生成的声音应该待在故事世界之内,那它必须在生成之后被放回那个空间:
- 透视关系。 隔壁房间的收音机是发闷、发小的。生成一条干净的近距离录音再把推子拉低,听起来不是「远」,而是「一条被调小的干净录音」。要在提示词里就写出隔墙、发闷,再补上和镜头匹配的房间混响。
- 对画面有反应。 场景音乐在门关上、摄影机移到室外时必须变。这是一遍自动化包络的活,不是一个生成参数。
- 统一的一个房间。 分几次生成的音效各自带着不同的隐含空间。给它们套上同一条共享混响,是让它们彼此认同的关键一步。
配乐是最省事的情况,也最值得优先交给 AI 音乐生成:它不需要服从空间,一段干净的生成音乐可以恒定音量铺在整段下面。但只要这段音乐被要求从画面里某个看得见的东西里发出来,它就变成了场景音乐,工作重心也就从「生成它」转到「把它放进空间」。