我做了一次 AI 写真:从一张自拍到 15 张成片的完整过程

我做了一次 AI 写真:从一张自拍到 15 张成片的完整过程

教程发布于

去影棚拍一套形象照,约时间、化妆、通勤、等修图,一周就过去了。我这次换了个做法:找了一张最普通的手机自拍当起点,全程在 ZOOOP 上做 AI 写真,最后拿到 15 张能直接用的成片 —— 商务形象照、生日、旅行、咖啡馆生活感各一组。

这篇把过程完整写一遍,包括中间翻车的地方。

为什么现在真的不用去影棚了

一年前我不会写这篇。那时候的模型换个衣服就换张脸,同一个人在三张图里像三胞胎,拿去当形象照根本不敢用。

现在变了的是「同一张脸」这件事。你给模型一张参考图,它能在换装、换光、换城市之后还保住原来的骨相和皮肤质感 —— 身份一致性一直是 AI 人像最难的一关,过了这关,AI 写真才从玩具变成能用的东西。影棚给你的是灯光和场地,而这两样恰好是模型现在最擅长模拟的。

真人摄影师仍然有不可替代的部分:现场沟通、抓你自己都不知道的表情、以及那些必须真实存在的场合照。这篇不打算说 AI 写真能取代拍照,只说它能替你省掉哪一类的拍照。

起点素材:一张普通自拍就够

我用的起点是这张,没有任何加工:

用来做 AI 写真的起点素材:一张普通手机自拍,自然光偏暗、没化妆、没修图

光线难看、构图随意、皮肤纹理和瑕疵都在 —— 这恰好是好素材。AI 人像最怕的起点反而是那种已经磨过皮、开过美颜的照片:模型会把滤镜当成你的皮肤本来的样子,后面每一张都带着一层塑料感。

AI 人像对起点素材的要求其实只有三条:脸朝正前方或接近正面、五官没被头发和眼镜遮住、分辨率别太低。满足这三条,手机随手拍的就够。真需要重拍的情况其实很少:严重侧脸、逆光只剩剪影、或者整张脸都在阴影里。

如果你想更稳一点,可以多拍两三张不同角度的一起喂进去 —— 参考图越多,模型对你的脸的判断越不容易跑偏。

换装、换发型、换妆容:三步锁住同一张脸

第一步换衣服。我把上面那张自拍当参考图,让它在同一片灰底和同一盏光下换三套:白衬衫、燕麦色针织、深灰风衣。

同一个人在同一光线下换三套衣服的 AI 写真三联图

三张的脸是同一张,这是这一步唯一要验的事。衣服的褶皱和材质对不对是次要的 —— AI 人像里脸一变,后面做得再好也白做。

第二步换发型和妆容,从素颜一路推到浓一点的:

从素颜到日常妆、到浓妆、再到短发波波头的 AI 人像四格对比

这一步我踩了个坑:一开始把「换发型」和「换场景」写在同一句提示词里,结果模型顾此失彼,发型对了脸就飘。后来拆成两次做,一次只改一件事,成功率立刻上去了。这是我这次最有用的一条经验 —— 每次只动一个变量。

AI 图像生成 出这一批的时候,提示词里我固定写死三样:同一个人、同一个机位、同一种光。剩下的才写这次要改什么。

换场景:同一张脸放进不同城市和光线

场景是 AI 写真最划算的一步 —— 真去拍,这三张要跑三个地方、等三种光。

同一个人在窗边柔光、街头黄昏、影棚黑背景三种光线下的 AI 写真

左边是窗边柔光,光包着脸走,阴影过渡很软;中间是街头黄昏,低角度的太阳擦着颧骨过去;右边是影棚黑底加单侧硬光,另半边脸直接压进暗部。

写提示词的时候,场景要连着光一起写。只写「在街上」模型只会给你一条街,写「黄昏低角度侧光、背景店铺灯光散焦」才会给你这张。光的方向、硬软、色温,这三个词对 AI 人像的影响比景物本身大得多。

四种常见场景的提示词模板

我按最常被要的四种场合各做了一张,可以直接照着改:

商务形象照、生日、旅行、咖啡馆四种场景的 AI 写真四格

商务形象照:浅灰纯色背景、正面均匀柔光、深色西装外套、闭嘴微笑、齐胸构图。别加环境元素,越干净越像正经证件照 —— 这也是最容易一次成的一类 AI 人像。

生日:暖色串灯做背景散焦、手里端蛋糕蜡烛、光源来自蛋糕本身(自下往上的暖光)、大笑。关键是把「蜡烛是主光」写出来,否则整张会平。

旅行:亚麻衬衫、日晒的石板街、风吹起头发、背景建筑过曝一点。这类图不要追求皮肤完美,一点粗糙感反而真。

咖啡馆生活感:靠窗侧光、双手捧杯、清晨的冷调白光、放松的半侧脸。别写「看镜头」,视线略偏更自然。

情侣和孕期这两类也能做,思路一样 —— 前者要在参考图里同时给两个人的脸,后者把体态和衣着写清楚。不管做哪种 AI 写真,改的还是那三件事:衣服、光、场景。

翻车合集:放大后才看得见的地方

100% 看没问题,放大到 200% 就是另一回事了。我把三个最容易出事的地方圈出来:

AI 写真最容易出问题的三处细节:手指、耳朵与眼镜腿、发际线边缘

。左边这张就是现成的反面教材 —— 手指的数量和关节位置一眼看着还行,细看会发现有两根粘在一起了。凡是构图里出现手,一定放大查。

耳朵、耳饰、眼镜腿。这三样经常互相穿模:眼镜腿从耳朵中间穿过去、耳钉长在耳廓上、两只耳朵不对称。戴眼镜的人做 AI 人像,这里的翻车率最高。

发际线和边缘。头发和背景交界处容易糊成一片或者出现硬边,黑发配浅背景时最明显 —— 这是 AI 人像最常被一眼认出来的地方。

三个地方都能救:圈出问题区域走一次 AI 图像编辑 局部重修,比整张重生成便宜也快。如果只是不够清晰,直接放大补细节就行,不用重跑。

我这次 15 张里有 3 张需要局部返工,大概是五分之一的返工率 —— 比我预期的低,但不是零。

让写真动起来

最后加了一步:把定稿那张送去 AI 视频生成,用 MiniMax H3 做了 5 秒。

由一张 AI 写真生成的 5 秒动态片段:头发被风吹动、人物转头微笑

风吹起头发、眨一次眼、转头带出一个笑 —— 头像页和社交主页放这个比放静态图抓人。要注意的是别写复杂动作:让一张 AI 人像「站着呼吸」比让它「走过来挥手」稳得多,动作一复杂,脸就开始变形。

一个人的完整清单

按顺序走,不会返工:

  1. 挑起点自拍 —— 正面、五官没遮挡、没磨皮
  2. 先换衣服,验证脸没变
  3. 再换发型和妆容,一次只改一样
  4. 最后加场景和光,场景和光写在一起
  5. 放大查手、耳朵眼镜、发际线
  6. 有问题的局部重修,不清晰的放大
  7. 挑一张做成动态

批量做的时候,我习惯把同一个人的所有 AI 人像版本铺在 生成式画布 上并排比,哪一张脸飘了一眼就看出来 —— 一张张点开看很容易被单张骗过去。

这次全程约两小时,大部分时间花在写提示词和挑片上,生成本身很快。AI 写真现在的水平,做形象照和社交素材已经够用;要交给客户的商业硬照,我还是会去找摄影师。想自己走一遍这个流程,从 AI 图像生成 开始就行,起点只需要一张自拍。

分享