声音跨过剪切点,改变了这一刀
画面剪切是瞬时的:这一帧是卧室,下一帧是街道,中间没有任何过渡状态。声音不是这样运作的,而声音桥利用的正是这个错配。
当一层音频不间断地跨过画面剪切点,观众就在一个不连续的时刻里被给了一个连续的东西可以握住。这条接缝不再是一次断裂,而变成了某个仍在进行的事情里的一次视角变化。这就是为什么声音桥是「表现时间流逝」、「在地点之间移动」、以及「在不明说的前提下把两件事主题性地连起来」的默认手法。
延续的方向改变含义。从上一场保留下来的声音读起来是回忆,或者是一个还没结束的念头;从下一场提前到来的声音读起来是预感,或者是未来在侵入。两者是同一个技法指向相反方向,而有意识地在它们之间做选择,就是这门手艺的大半。
值得区分的几种
- 延后型。 外切的声音延续到入切的画面上。反思的、余音未散的。
- 提前型。 入切的声音在它的画面之前先响。预感的、有推力的,在当代剪辑里比前者更常见。
- 中性第三层。 配乐、雨声,或者一段抽象质感,不属于任何一场,横铺在接缝上。当两场戏各自都有会打架的具体声音时很好用。
- 声音上的匹配剪。 两个不同来源听起来相似,于是这一刀像一个持续着的单一声音:水壶变成警笛、掌声变成雨声。这是最过瘾的版本,也是最难找到素材的版本。
以上全部需要的都是「内部结构不强」的音频。一段连续的低鸣、人群声、一个延续的音,都桥得很好;一句对白、或者一段有明确乐句结尾的音乐则不行,因为那个声音会宣告自己的边界,观众还是听得到接缝。
画面是生成的时候怎么搭
这里有一个具体的坑:会产出原生音轨的视频模型,给你的是每个片段一个融合文件,而那段音频没法延伸到自己那个镜头之外。声音桥按定义就必须跨过镜头边界,所以原生音频让这个手法直接不可用。
可行做法是从一开始就把音频当成独立的一层。
画面按无声生成,或者把原生音轨丢掉。然后用文字生成音频模型,把桥用的声音生成成一个长文件,比任何一个镜头都长:一条连续垫底,没有事件,除非你要,否则明确排除音乐和人声。
把这条垫底横铺在两个片段上,让它真正不间断,然后把每场戏各自具体的音效放在它上面的独立轨道里。具体那几层可以跟着画面剪,垫底不剪 —— 这恰好就是这个效果需要的结构。
画面这一侧也有一个提示词细节要紧:接缝两侧的镜头里都该有一点空白,一两秒什么都不发生的时间,因为桥需要有个落脚处。一个从第一帧满到最后一帧的片段,让音频无处呼吸,转场最后会显得挤,而不是显得连贯。