它换来什么,又付出什么
要的就是分离。一张脸在杂乱街道前面,和街道是在竞争关系里,直到街道不再可读;而失焦是唯一能在机内去掉背景信息、又不去掉背景本身的手段。它同时读起来「有制作费」,因为薄的清晰范围需要大光圈镜头、可控的距离,以及一个真正在盯焦点的人。
代价是信息。所有被虚掉的东西都是你再也用不上的语境:地点、时辰、其他角色、背景里的那个笑点。喜剧和群戏经常拒绝这个味道,原因正在这里。它还会压平纵深线索,所以清晰范围过薄的镜头有时会让人觉得主体是浮在一块屏幕前面,而不是站在一个地方。
还有一项只在现场才显形的代价:余量。清晰范围薄,就意味着任何小误差都会变成一条软掉的镜头,演员换个重心、稍微重构一下画面、一次呼吸,都算。
怎么做出来
四个输入是叠加的,把它当成预算而不是一个旋钮更好用。
- 开大光圈。 最直接的一步,上限由你手里那只镜头硬性决定。
- 换长焦并后退。 85mm 站四米的分离效果远好于 35mm 站一米,而且对脸更友好。
- 靠近主体。 单位努力回报最高的一项,还免费。
- 把背景推远。 最常被忘、往往收益最大的一条。主体离墙一米,任何光圈都不可能虚掉背景;把他挪到离墙六米,同一只镜头就替你干完了活。
如果目标是「分离」而不是特指「虚化」,第四条值得先试,因为它不花钱,也不吃掉你的对焦余量。
生成图像在这方面的脾气
模型默认就往这个方向用力过猛。训练图注里提到 portrait、cinematic、professional 的图,绝大多数背景都被摧毁了,所以模型学到的是「虚化 = 好」。结果是你通常需要要求「少一点」,而不是「多一点」。
真的要它的时候,描述边界,而不是点名效果:
- ✅
85mm at f/1.4, both eyes sharp, background reduced to soft shapes - ✅
sharp on the hands in the foreground, face already softening behind them - ⚠️ 只写
shallow depth of field,虚化量不可预测,而且经常过量 - ⚠️ 写
blurry有风险,可能换来运动模糊或主体发软
点名「清晰的那部分」之所以更有效,是因为模型画内容很自信、推深度很差。告诉它什么必须脆,等于给了它一个锚;告诉它去虚化,等于给了它虚化任何东西的许可。
值得做的检查
放大看过渡区。可靠的失败有三种:沿主体轮廓的一圈锐利光环;头发或手指被分到错误的平面;以及一个均匀柔化、从近到远完全没有梯度的背景,那是真实镜头做不出来的。也要看文字:主体后方相当远的招牌应该不可辨认,如果它很脆,说明虚化是画上去的而不是推出来的。
视频要看两遍。虚化边界经常在蠕动,背景元素会在没有任何运镜理由的情况下在清晰和柔和之间来回。放慢运镜和缩短时长都能减轻;而一个稍微不那么极端的效果,完整活过一整条素材的概率要高得多。