99 个术语
AI 与影视术语库
描述一个镜头需要的词,和生成这个镜头需要的词,都在这里。每条术语都配一段在 ZOOOP 上真实生成的示例,以及背后完整的提示词。
A
ADR(对白补录)
剪辑与声音ADR 是 automated dialogue replacement 的缩写,指拍摄结束后在录音棚里重录对白、再对回画面的工序。现场声没法救、剪辑中改了台词,或者导演想要另一种念法时,就得走 ADR。
automated dialogue replacement · 对白补录 · 后期配音 · looping
AI 幻觉
模型与参数AI 幻觉指模型自信地给出、但其实是错的或凭空编造的输出。在文本里它表现为编造事实;在图像和视频里,它表现为六根手指的手、招牌上无法辨认的文字、不成立的物理,以及放大工具补出来的、源图里根本不存在的细节。
ai hallucination · hallucination · 幻觉 · 模型幻觉
C
CFG Scale
模型与参数CFG scale 是无分类器引导(classifier free guidance)的强度,它决定模型被朝着你的提示词推多远、离「不给提示词时它本来会画的东西」多远。数值低画面松软发灰,数值高画面死板高反差,而每个模型家族都有自己的合理区间。
what is cfg scale · guidance scale · classifier free guidance · 提示词引导强度 · cfg 值
CLIP 模型
模型与参数CLIP 模型是一对编码器,一个读文字、一个读图像,训练目标是让一句描述和它对应的图落在同一个共享嵌入空间里的同一个位置。图像生成模型用的是它的文本编码器,把提示词变成能操纵生成过程的一串数字。
clip · text encoder · 文本编码器 · clip score · t5 编码器
ControlNet
模型与参数ControlNet 是挂在扩散模型上的一个附加网络,它用从参考图里提取出的结构图(骨架、深度图、边缘线等)作为额外条件。风格和内容仍由提示词决定,但画面的布局被你给的那张结构图钉死。
what is controlnet · ip adapter · 控制网 · openpose · 深度图控制
G
J
L
T
U
V
#
一致性模型(Consistency Model)
模型与参数一致性模型的训练方式是让噪声到成图这条轨迹上的任意一点都直接映射到同一个终点,于是它一到四步就能出成品,而不需要几十步。目录里各种 fast、turbo、flash、lightning 档位,背后基本都是这套蒸馏技术。
consistency model · model distillation · lcm · 模型蒸馏 · 步数蒸馏
三分法
画面与构图三分法是用两条横线、两条竖线把画面切成九宫格,再把主体或地平线放在交叉点或线上,而不是放在正中央。主体偏离中心之后,两侧留白不再相等,画面就有了方向,视线不会落在主体上就停住。
九宫格构图 · rule of thirds · 三分构图法
三点布光
灯光三点布光是最基础的一套布光结构:主光决定曝光和阴影方向,补光决定暗面能暗到什么程度,背光把人物从背景上剥离出来。它是入门脚手架而不是规矩,成片里只用一两只灯的情况非常多。
三点式布光 · 三光源布光 · three point lighting
中景
镜头与机位中景镜头大致把人框在腰部以上,近到能读清表情,又宽到能看见手势和体态。它是对话戏的默认档位,因为表情和肢体语言能同时留在同一个画框里,不需要观众二选一。
中景镜头 · 中景别 · 腰部景 · medium shot
主光
灯光主光是一套布光里起支配作用的那只光,它定下曝光,也决定每一道阴影落在哪里。它的位置决定人脸的形状,它的面积决定阴影边缘的软硬,其余所有灯都是对它的回应。
主光源 · key light · 主灯
主观镜头
镜头与机位主观镜头是把摄影机放在某个角色眼睛的位置上,让观众看到这个角色正在看到的东西。它只有在剪辑交代了「这是谁的眼睛」时才成立,所以通常夹在一个「看」的镜头和一个「反应」的镜头之间。
POV 镜头 · pov shot · 第一人称视角 · 视点镜头
主镜头
镜头与机位主镜头是用一个不间断的镜头把整场戏从头到尾拍完的那条素材,画面要宽到能装下所有演员和所有重要动作。它是剪辑随时可以切回去的那一条,也是让后面所有近景保持一致的参照。
主机位 · master shot · 全场镜头
交叉剪辑
剪辑与声音交叉剪辑是在两条或多条发生在不同地点、通常同时进行的动作之间来回切换,让观众同时跟住两边。它是剪辑师制造悬念、建立对比,或者把分开的几条线拧成同一个事件的标准手段。
cross cutting · 平行剪辑 · 交替剪辑 · parallel editing
仰拍
镜头与机位仰拍镜头把机位放在主体视线以下、镜头朝上看。这个视点让主体压在观众头顶上,读起来就是力量、威胁或英雄感,同时它会把画面里的地面换成天花板或天空。
仰拍镜头 · 低角度镜头 · 仰角 · low angle shot
体积光
灯光体积光指能在空气中被看见的光,它以光束或光柱的形态出现,因为雾、烟、灰尘的颗粒把光散射回镜头方向。它同时需要三个条件:一个有明确边界的光源、空气里有可散射的介质、以及一块够暗的区域让光束能被看出来。
耶稣光 · 光束 · god rays · volumetric lighting
俯拍
镜头与机位俯拍镜头把机位放在主体视线以上、镜头朝下看。往下看会让主体在地面的衬托下变小,读起来是脆弱、暴露或被监视,同时它把背景里的天空换成了地面。
俯拍镜头 · 高角度镜头 · 俯角 · high angle shot
俯视镜头
镜头与机位俯视镜头是从高处近乎垂直向下拍摄的镜头,镜头轴线大致垂直于地面。纵深被压平,人物于是读成在一个平面上移动的形状,而不是我们身边站着的人。
顶视镜头 · 垂直俯拍 · overhead shot · bird's eye view shot
光流(Optical Flow)
AI 生成任务光流(optical flow)是一张逐像素的运动图:对每个像素,它给出这块内容从这一帧移动到下一帧的二维位移向量。插帧、视频转视频、防抖、视频放大都靠这份测量来判断「哪些东西跨帧应该保持不变」,所以它是时序一致性背后的机器。
光流场 · 运动估计 · 时序一致性 · optical flow
关键帧
AI 生成任务关键帧是你预先固定、要求模型必须经过的一帧。在 AI 视频里真正重要的是两个,首帧和尾帧,只要提供其中任意一个,一次开放式生成就变成了受约束的生成。这是对一致性影响最大的单一手段。
首帧 · 尾帧 · first frame · last frame · 首尾帧
分词器
模型与参数分词器(tokenizer)负责把文本切成模型能处理的离散单元,再把每个单元映射成一个 id、进而查成向量(embedding)。它决定了你的提示词到底有多少内容真被读进去,也决定了生僻词会被切成什么碎片,这就是为什么冷门名字经常生成出毫不相干的东西。
tokenizer · embedding ai · token · 词元 · 文本编码器
动作匹配剪辑
剪辑与声音动作匹配剪辑把剪切点放在一个动作的中途,同一个动作在前一个镜头开始、在后一个镜头完成。因为眼睛正忙着追这段运动,换机位就被读成连续的而不是中断,这也是藏起一次剪切最可靠的办法。
match on action · 动作中剪 · cutting on action · 动作衔接剪辑
动作迁移(Motion Transfer)
AI 生成任务动作迁移(motion transfer)是把驱动视频里主体的运动搬到另一个角色身上,让一张静图或一个新身份做出同样的动作。管线先从驱动视频抽出姿态序列,再按目标的身材比例做重定向,最后以这条序列加上你的身份参考为条件生成每一帧,所以它也叫姿态迁移。
姿态迁移 · pose transfer · motion transfer · 驱动视频
匹配剪辑
剪辑与声音匹配剪辑把两个共享同一个形状、动作、声音或概念的镜头接在一起,让这次转换读起来是有意的连接而不是断裂。它是在不用叠化、不打字幕的情况下跨越场景、时间和地点的标准做法。
match cut · 图形匹配 · graphic match · 声音匹配
升降镜头
镜头与机位升降镜头是把摄影机装在摇臂或升降臂上拍的镜头,机位在拍摄过程中真的在空中升起、下降或划弧。定义它的是垂直方向的位移,这一点让它区别于只在地面移动的推轨,也区别于只做旋转的俯仰摇。
摇臂镜头 · crane shot · jib shot · 升格臂
去噪强度
模型与参数去噪强度决定你的输入图被推回噪声多深,再由扩散模型从那里重新去噪,也就等于决定了原图还剩多少。采样步数决定这次重建走多少步。图生图的所有调参,基本都是在这两个数之间做取舍。
denoise · denoising strength · sampling steps · 重绘幅度 · 采样步数
反向提示词
模型与参数反向提示词是另一段文字,模型会被朝着它的反方向推,和正向提示词正好镜像。它压制风格、材质和反复出现的瑕疵很有效,但要把某个具体物体从画面某个具体位置抹掉,它基本不灵。
negative prompt · negative prompting · negative prompt examples · 负面提示词 · 排除词
变形宽银幕镜头
画面与构图变形宽银幕镜头用柱面镜片把更宽的视野沿水平方向压缩到传感器上,后期再横向拉回,得到 2.39:1 的宽画幅。正是这次「压缩」带来了椭圆光斑、横向蓝色光带和边缘拉伸这一整套特征。
anamorphic lens · anamorphic · 变形镜头 · 压缩比
变焦点
镜头与机位变焦点是在一个镜头进行当中把对焦平面从一个主体移到另一个主体上,让观众注意力发生转移,既不用切也不用动机位。它成立的前提是浅景深,以及两个主体到镜头的距离明显不同。
拉焦 · 移焦 · rack focus · focus pull
口型同步(Lip Sync)
AI 生成任务口型同步(lip sync)是让照片或视频里的一张脸对上给定音频的任务。模型逐帧重画嘴、下颌,通常还包括整个下半脸,让口型与声音对齐,画面其余部分保持原样。
对口型 · lip sync · lipsync · 音频驱动
图像分割
AI 生成任务图像分割是把一张图在像素级别切成带标签的区域,产出的是一张遮罩,而不是一个方框。在生成管线里,它决定了「一次编辑允许动哪些像素」,所以抠背景、物体移除、局部重绘、单主体调色都建立在它之上。
语义分割 · 实例分割 · 抠图 · 遮罩
图生图(i2i)
AI 生成任务图生图(image to image,常缩写为 i2i)是一种生成任务:输入图会约束输出。模型改写的是一张已有的画面,不是从纯噪声开始,所以构图、色彩、姿态会按「强度」这个参数所允许的程度被继承下来。
i2i · img2img · image to image translation · 图像转换 · 参考图
图生视频(i2v)
AI 生成任务图生视频(image to video,常缩写为 i2v)是一种生成任务:一张静态图作为片子的起始帧,模型只需要负责编造运动。观感被你给的这张图锁定,视频生成里最大的随机来源就此被拿掉。
i2v · img2vid · image2video · 图片转视频 · 首帧动起来
场景灯(practical light)
灯光场景灯(practical light)指出现在画面之内、并且真的亮着的光源,比如台灯、蜡烛、霓虹招牌、电视、车头灯。它给观众一个看得见的理由来解释画面里的光,在当代拍摄里往往还承担了实际的照明工作。
实用光 · 画内光源 · practical light · 有出处的光
基础模型(Foundation Model)
模型与参数基础模型指的是在广泛数据上预训练一次、再被适配到很多下游任务的大模型,而不是为某一个任务单独训出来的模型。在生成式媒体里,它就是整个生态挂靠的那个底座:微调、LoRA、控制适配器、蒸馏出来的快速版本、各种任务变体,全部都是针对某一个具体底座做的。
foundation model · base model · 底座模型 · 预训练模型
声音克隆(Voice Cloning)
AI 生成任务声音克隆(voice cloning)是用一段真人录音建出一个合成音色,再用这个音色去读新的文本。现在的零样本系统只需要几秒到几十秒音频:模型从参考片段里抽出一个说话人向量,再让语音合成以它为条件,所以每换一个音色都不需要重新训练。
音色克隆 · voice clone · voice cloning · 零样本 TTS
多模态 AI
模型与参数多模态 AI 指的是能读入或产出多种数据类型的模型,通常是文字、图像、视频、音频的某种组合,并且这些信号共享同一套内部表示。在创作工具里,它就是你能同时递给模型一张参考帧和一句修改要求、而模型同时看懂两者的原因。
multimodal ai · multimodal model · 多模态模型 · omni 模型 · 视觉语言模型
定场镜头
镜头与机位定场镜头是在一场戏里任何事情发生之前,先告诉观众这场戏发生在哪里的那个画面。它通常是宽的、通常放在最前面,任务是把一个地点的空间关系交出去,让后面所有更紧的镜头都能被顺利读懂。
交代镜头 · 建立镜头 · 重新定场 · establishing shot
局部重绘(Inpainting)
AI 生成任务局部重绘(inpainting)只重新生成你画出的遮罩范围内的像素,遮罩之外一个像素都不动。要去掉一个物体、换掉一处细节、修掉一个错误,而不想重渲整张图,用的就是它。而结果好不好,取决于遮罩的程度远大于提示词。
inpainting · ai inpainting · video inpainting · 消除笔 · 遮罩重绘
引导线
画面与构图引导线是画面中具有线性特征的元素,比如一条路、一段栏杆、阴影的边界、一排立柱,它把观众的视线沿着一条路径牵向主体。它有效是因为视觉会自动追踪连续的边缘,于是这条线决定了什么先被看到、按什么顺序被看到。
leading lines · 汇聚线 · 透视线 · 对角线构图
微调(Fine-Tuning)
模型与参数模型微调是在一个预训练模型上继续训练,用你自己的图教它一个它原本不认识的人、风格或产品。它真的改动了权重,这是它和写提示词、给参考图的根本区别,也是它应该排在最后而不是最前的原因。
dreambooth · textual inversion · checkpoint model · stable diffusion checkpoint · 底模
扩图(Outpainting)
AI 生成任务扩图(outpainting)是把一张图向原有边框之外延伸:放大画布,把新增的空白区域标成待填充区域,模型依据边缘已有的像素补出画外本该有的内容。它和局部重绘用的是同一套遮罩机制,区别只在于填的是框外还是框内。
外扩 · 图像扩展 · outpainting · generative fill
扩散 Transformer(DiT)
模型与参数扩散 Transformer 指的是把扩散模型的去噪主干从卷积 UNet 换成 Transformer:潜空间被切成小块,每一块变成一个 token,每一层里每个 token 都能看到其他所有 token。正是这一个改动,让现在的模型能写出可读的字、能吃下长提示词,也让视频从「几帧」变成「以秒计」。
dit · diffusion transformer · mmdit · 扩散 transformer · Transformer 主干
扩散模型
模型与参数扩散模型的生成方式是从一片随机噪声出发,每一步去掉一点噪声,在提示词引导下预测「噪声更少时这张图该是什么样」。它训练时学的是把一个逐步加噪的过程反过来走,而这种一步一步的结构,正是它可被引导的原因。
diffusion model · 潜扩散 · latent diffusion · 视频扩散 · 去噪扩散
拍摄角度
镜头与机位拍摄角度指机位相对主体视线高度所处的位置,它决定观众被邀请怎么看待这个主体。角度不改变画面里有什么,只改变你站在哪里看,所以同一段表演从下往上拍显得强势,从上往下拍就显得脆弱。
机位角度 · 镜头角度 · 摄影机角度 · camera angles
拟音
剪辑与声音拟音是在录音棚里对着画面用手工现场表演日常声音、再干净录下来交给混音的工序。成片里的脚步声、衣服摩擦声、钥匙、杯子、门把手,基本都是拟音做的,而不是现场同期录到的。
foley · 拟音师 · foley sound · 音效拟音
提示词工程
模型与参数提示词工程是有意识地组织模型输入、让结果落在你想要的位置上的方法。对图像和视频模型来说,它主要关乎用词顺序、具体程度和权重,因为这类模型并不像对话模型那样执行指令,它做的是把一段描述和图像对上。
prompt engineering · 提示词 · 咒语 · 提示词模板 · 提示词权重 · 系统提示词
插入镜头
镜头与机位插入镜头是场景内部某个细节的紧构图,比如按在门把上的手、表盘、一张字条、桌上的枪,被切进周围的分镜里。它承载宽画面装不下的信息,同时给剪辑一个压缩时间或者藏接点的位置。
插入特写 · 空镜切入 · insert shot · cutaway shot
摇摄与俯仰
镜头与机位摇摄和俯仰是摄影机在原地转动的两种方式:摇摄让它水平转,俯仰让它上下转。两者都不改变机位所在的位置,这正是它们和跟拍、升降的根本区别,后两者是机位本身在空间里移动。
摇镜头 · 俯仰摇 · pan and tilt · zoom in zoom out
文生图(T2I)
AI 生成任务文生图(text to image,T2I)是一种生成任务:模型只读一段文字提示,不需要参考图,直接产出一张静态图。它是从学到的分布里采样,而不是去检索,所以同一段文字换一个随机种子,出来的是另一张同样成立的图。
t2i · txt2img · text to image model · 文本生成图像
文生视频(T2V)
AI 生成任务文生视频(text to video,T2V)是一种生成任务:模型只接受一段文字提示,不需要参考图,直接产出一段视频。主体长什么样、怎么取景、怎么运动,全部由模型一次性决定,这也是它可控性最低、最适合探索的原因。
t2v · txt2vid · text to video model · 文本生成视频
明暗对照法(Chiaroscuro)
灯光明暗对照法(chiaroscuro)指用强烈的明暗反差来塑造形体,通常只用一只硬光、几乎不补光。这个词在意大利语里就是「明」加「暗」,从文艺复兴绘画一路被电影黑色和恐怖片沿用,做法几乎没变。
明暗对比 · 明暗法 · chiaroscuro · 暗调光
景别与镜头类型
镜头与机位景别是描述一个镜头「装了主体多少」的标准说法,再加上机位角度和摄影机运动,才构成完整的镜头类型。三项都写清楚,这个镜头才是别人(或模型)能复现出来的。
镜头类型 · 镜头景别 · 镜头术语 · 摄影机镜别
景深
画面与构图景深指场景中看起来足够清晰的最近点与最远点之间的距离。清晰范围窄,主体就从虚化里被拎出来;清晰范围宽,前景和背景可以同时被读到。影响它的有四件事:光圈、焦距、被摄距离、传感器尺寸。
depth of field · DOF · 大景深 · 清晰范围
有声源声音
剪辑与声音有声源声音指存在于故事世界之内、片中角色能够听到的一切声音:对白、脚步、汽车引擎、房间里开着的收音机。角色听不到的部分,比如配乐和旁白,属于无声源声音(non-diegetic)。
diegetic sound · 无声源声音 · non-diegetic sound · 叙事内声音
框中框
画面与构图框中框指用场景里的门洞、窗户、镜子、拱门或垂下的树枝把主体围住,在画面的四条边之内再形成一层边框的构图方式。它能带来纵深、指定注意力落点,也能暗示被困住或被窥视。
frame within a frame · 框架构图 · 前景框 · 门框构图
流匹配(Flow Matching)
模型与参数流匹配是一种训练目标:让模型学会一个速度场,把噪声沿着接近直线的路径搬到数据。整流流(rectified flow)就是其中路径取直线的那个版本,现在主流的图像和视频家族都建在它上面。因为路径是直的,采样只需要经典扩散调度的几分之一步数就能到同样的画质。
flow matching · rectified flow · 整流流 · 修正流 · 速度预测
浅景深
画面与构图浅景深指画面里只有很薄的一层是清晰的,比它更近和更远的部分都落进虚化。这是把主体从背景里分离出来的标准手段,由大光圈、较长焦距和较近的被摄距离共同造成。
shallow depth of field · 浅焦 · 主体分离 · 大光圈虚化
深度图(Depth Map)
AI 生成任务深度图(depth map)是一张灰度图,每个像素记录的不是颜色,而是这一点离相机有多远,惯例是近处亮、远处暗。生成管线把它当作结构控制信号:它携带了画面的空间布局和体积,却不携带风格,所以可以只换观感、不动位置。
深度估计 · 单目深度 · depth map · z-depth
滑动变焦
镜头与机位滑动变焦是让摄影机朝主体推进或后退的同时,把镜头焦段朝相反方向变焦,于是主体大小不变,而背景看起来在被拉长或压扁。主体不动、身后的世界在变形,这就是它读起来像眩晕或像一个念头突然落地的原因。
希区柯克变焦 · 眩晕变焦 · 移动变焦 · dolly zoom
潜空间
模型与参数潜空间是生成模型真正干活的那个压缩坐标系,在里面一张图是几千个数字而不是几百万个像素。生成的过程就是在这个空间里走一条路径,最后再解码回像素。这解释了为什么固定种子能复现,也解释了为什么相邻两点看起来像亲戚。
latent space · latent · 隐空间 · 潜在空间 · 潜变量
焦外虚化
画面与构图焦外虚化指画面中失焦区域的「质感」,而不是虚化的程度。它包含失焦光点的形状、虚化过渡是否平滑、背景是化开还是碎成一堆亮边。虚化质感由镜头设计决定,光圈只决定你能看到多少。
bokeh · 散景 · 背景虚化 · 光斑
特写
镜头与机位特写镜头让一样东西填满画面,最常见的是肩以上的一张脸,或者一个单独的物件。因为语境被裁掉了,观众没有别处可看,所以这一档承担的是情绪、决定和细节。
特写镜头 · 大特写 · 近景特写 · close up shot
生成式 AI
模型与参数生成式 AI 指的是通过「从训练中学到的概率分布里抽样」来产出新内容(图像、视频、音频、文本)的模型,而不是检索或修改一份已有文件。因为每次运行都重新抽一次样,所以输入没变,结果也会变。
generative ai · gen ai · 生成式人工智能 · AIGC
甩镜
镜头与机位甩镜是把摇摄做到极快、画面被拖成横向条纹的镜头。它有两种用法:一是在镜头内部作为一次暴力的注意力转移,二是横跨两条素材,用运动最模糊的那几帧藏住剪辑点,让两段看起来像一次连续的机位转动。
甩镜头 · 快摇 · whip pan · swish pan
电影感灯光
灯光电影感灯光不是某一种技术,而是一套习惯:光有一个主导方向、允许画面里有真正的暗部、光源在场景里说得通、并且把光修形成只照亮一部分画面。剧组几乎不说这个词,他们直接说具体的技术名。
电影级布光 · 影视灯光 · cinematic lighting · 布光技巧
画幅比例
画面与构图画幅比例是画面宽度与高度之比,写成「宽:高」。它在任何东西被放进画面之前就决定了画面的形状,因此对构图的约束比其他任何单一设置都强。16:9 是横屏默认值,9:16 是竖屏,2.39:1 是宽银幕电影的形状。
宽高比 · 长宽比 · aspect ratio · 16:9 aspect ratio · 9:16 aspect ratio · 2.39:1 aspect ratio · cinemascope
视频转视频(vid2vid)
AI 生成任务视频转视频(video to video ai,常缩写为 vid2vid)以一段现成素材为主输入,把它重新渲染一遍:换风格、换光、换掉画面里的某个物体,而原本的运动和节奏被保留下来。难点从来不是新观感,而是让这套观感在每一帧上都一模一样。
vid2vid · v2v · video to video ai · 视频风格化 · 视频重绘
种子(Seed)
模型与参数随机种子是一个整数,扩散模型从它生成的那团随机噪声出发开画。种子和其余设置全部不变,你就能拿到完全相同的输出,这一步让生成从摇老虎机变成一次「每次只动一个变量」的受控实验。
seed · image seed · random seed · 种子值 · 固定种子
移轴镜头
画面与构图移轴镜头能相对传感器做两种独立运动:倾角(tilt)让对焦平面不再与传感器平行,平移(shift)把镜头上下左右挪动以保持垂直线平行。倾角带来的是著名的「模型玩具」效果,平移解决的是建筑往里倒的问题。
tilt shift · tilt shift lens · 移轴 · 微缩模型效果
背光(逆光)
灯光背光是放在被摄体背后、朝被摄体打的光,它在人物边缘勾出一条亮线,把人从背景上剥离出来。继续加强就变成剪影;场景里有烟、雾或雨时,它还是唯一能让空气本身被看见的光。
逆光 · 轮廓光 · 发光(hair light) · back light
胶片颗粒
画面与构图胶片颗粒是感光乳剂里的卤化银晶体在显影后结团所形成的可见质感。感光度越高的胶片晶体越大、颗粒越粗。数字传感器根本没有颗粒,所以现在这层质感是被刻意加回去的,用来压住数字画面的过度干净,或标明年代与画面格式。
film grain · 颗粒感 · 噪点与颗粒 · 胶片模拟
自回归模型
模型与参数自回归模型每次只产出一个元素,而且每一个新元素都以已经产出的全部内容为条件。语言模型就是这么工作的,越来越多的图像和视频模型也是:它们按顺序预测画面 token 或者视频帧,而不是并行地对整张画布做去噪。
autoregressive model · ar model · 自回归 · 下一个 token 预测
荷兰角
镜头与机位荷兰角是把摄影机沿镜头轴向侧倾、让地平线倾斜而不是水平的一种拍法。倾斜本身传达失衡感,所以常用来表现不安、迷失,或角色正在失去控制。
斜角镜头 · Dutch angle · canted angle · 倾斜构图
蒙太奇
剪辑与声音蒙太奇是把若干短镜头剪在一起,用来压缩时间、交代过程,或者组装出任何单个镜头都承载不了的一个意思。它的含义来自镜头之间的关系,而不是来自某一个镜头里发生了什么。
montage · 蒙太奇段落 · 蒙太奇手法
蓝调时刻
灯光蓝调时刻指日出前和日落后太阳已在地平线以下、只剩下天空散射光的那段时间,光偏冷、很柔、几乎没有方向。它真正的价值在于平衡:有短短一段时间,天空和场景里的人工光处在同一个曝光量上。
蓝色时刻 · 民用暮光 · blue hour
补光
灯光补光的作用是抬起被摄体暗面的亮度,同时不产生属于自己的阴影,因此它是一套布光里控制反差的主要手段。它的量以与主光的光比来衡量,而用黑旗把环境光减掉(负补光)和加灯一样是正经技术。
辅助光 · 补光灯 · fill light · 负补光
补帧(Frame Interpolation)
AI 生成任务补帧(frame interpolation)是在已有的两帧之间合成新帧,用来提高片子的帧率,或者把它拉成慢动作。现代做法会先估算每个像素在两帧之间怎么移动,再沿着这个运动方向渲染中间帧,而不是把两张图叠在一起做溶解。
frame interpolation · video frame interpolation · 插帧 · 提帧率 · 中间帧
负空间
画面与构图负空间指画面中主体周围和主体之间的空白区域。它不是剩下的地方:空白的大小和形状决定了主体的尺度、方向和情绪重量,这也是为什么刻意留空的画面读起来是安静、孤独或紧张,而不是没画完。
negative space · 留白 · 空白空间
超分放大(Upscaling)
AI 生成任务超分放大(upscaling)是把图像或视频的像素尺寸变大。传统重采样只是把已有像素撑开,越大越糊;AI 超分(super resolution)则用模型合成源文件里本来不存在的细节,所以它能比原图更锐,也正因如此它可能悄悄改掉一张脸。
upscaling · super resolution · 超分辨率 · AI 放大 · 图片放大
跟拍镜头
镜头与机位跟拍镜头是摄影机本身在空间里移动、跟着运动的主体走,让主体大致停在画面同一个位置、背景不断从旁边掠过的拍法。定义它的是机位的位移,不是摇摄,也不是变焦。
移动镜头 · 随行镜头 · tracking shot · follow shot
跳切
剪辑与声音跳切是从一个连续镜头的中间挖掉一段时间,画框基本不变,主体却像往前跳了一下。它是故意破坏连贯性,所以读出来要么是焦躁、时间在流走,要么在口播视频里就只是单纯的压缩。
jump cut · 跳跃剪辑 · jump cuts
轮廓光
灯光轮廓光是沿被摄体边缘出现的那条细亮线,由摆在人物后方稍偏一侧的光源产生。它本质上是一个反差效果,所以在暗背景前才清楚,在亮背景前会完全消失。
边缘光 · 勾边光 · rim light · edge light
过肩镜头
镜头与机位过肩镜头越过一个角色的肩膀去框住另一个角色,让观众大致站在倾听者的位置上看说话的人。近处那个肩膀把画面锚在一个真实空间里,这正是它让一段对话看起来是共处的、而不是由两张单人肖像拼起来的原因。
越肩镜头 · 肩上镜头 · OTS · over the shoulder shot
运镜
镜头与机位运镜指一个镜头进行中摄影机改变位置或朝向的各种方式,从原地转动的摇镜到在空间里行进的推轨。运动交付的是时间维度上的信息,所以一个动起来的镜头是在揭示、跟随或重新构图,而不只是呈现。
镜头运动 · 摄影机运动 · 运镜方式 · camera movements
远景
镜头与机位远景镜头把主体完整装进画面,上下都留出可见的空间,让观众同时读到主体和它所处的环境。它是那个负责交代「这场戏发生在哪、人是怎么摆放的」的档位,所以一场戏通常都是从它向内搭建起来的。
远景镜头 · 全景 · 大远景 · wide shot
连续性剪辑
剪辑与声音连续性剪辑是一整套让剪切显得不存在的惯例,使一场由许多独立镜头拼起来的戏被读成一个连续发生的事件。它的核心规则包括轴线规则(180 度规则)、视线匹配、银幕方向一致,以及在动作中剪。
continuity editing · 轴线规则 · 180 degree rule · eyeline match · 视线匹配
逐帧抠像(Rotoscoping)
AI 生成任务逐帧抠像(rotoscoping)是把运动主体逐帧从背景里分离出来的工序,产出的是一张可用于合成的 alpha 遮罩。它最早是把实拍胶片一帧帧投在玻璃板上描出来,如今主要由分割与抠像模型自动给出遮罩,人工只负责修。
rotoscoping · alpha matte · 抠像 · 绿幕 · 转描
镜头光晕
画面与构图镜头光晕是没有参与成像的杂散光在镜片之间反射、散射后落到画面上的结果,表现为条状光带、彩色鬼影光斑,或是一层让黑位发灰的乳白雾。它出现的条件是强光源在画内,或就在画框之外。
lens flare · 耀光 · 鬼影 · 变形镜头光晕
长镜头
镜头与机位长镜头是一条不中断的镜头,时长远超它周围的平均镜头长度,常常一分钟以上,让一整场戏在没有任何剪辑的情况下走完。唯一的条件是时长:机位可以完全固定,也可以一路穿过整栋建筑。
一镜到底 · long take · oner · 段落镜头
风格迁移(Style Transfer)
AI 生成任务风格迁移(style transfer)是把一张图的观感,也就是它的配色、笔触、肌理和光感,套到另一张图的内容上。早期的神经风格迁移是直接对一张输出做两路损失的优化;现在的扩散管线用风格参考图或提示词完成同一件事,更快更灵活,但对肌理的复制不再那么字面。
神经风格迁移 · 风格参考 · style transfer · 图像风格化
黄金时刻
灯光黄金时刻指日出后和日落前那段太阳位置很低的时间,阳光要穿过更厚的大气层才到达地面,因此偏暖、偏柔,方向感强。长影子加上整片天空补亮暗面,是它显得好看的真正原因。
黄金时段 · 魔法时刻 · golden hour · magic hour
黄金比例构图
画面与构图黄金比例构图按 1:1.618 这个比例安排主体位置,形式有两种:一是分割线比三分法更靠中心的黄金网格,二是让视线向内追随的黄金螺旋。它可以看作三分法收紧一点的替代方案,其中真正有实用价值的是螺旋。
golden ratio composition · 黄金分割构图 · 黄金螺旋 · 斐波那契螺旋 · composition techniques photography