AI生图同一个人总变脸,靠把提示词写得更长通常治不好。多数生图工具每点一次生成,就是从噪声里重新画一张:没有可复用的参照时,上一张的脸型、发型和年龄感不会自动带到下一张。想做一组能连起来看的图,顺序要反过来:先定一张标准像当参照,再把长相写成一份固定清单,之后每张只改场景和动作,工具支持种子时也一并锁住。适合做绘本、系列配图和固定人设账号的人,按下面四个办法走,漂移会明显变小。
每点一次生成,都是一次重新抽图
变脸的根源不在你描述得不够认真,而在生成方式本身。像“年轻女孩、长发、温柔”这类词,对应的长相范围非常大,模型每次采样落点都不同,凑出来的自然不是同一张脸。形容词堆得再多,也只是在缩小范围,没法把某一张具体的脸钉住。特写和远景混用、正脸和大侧脸混用,也会让五官被重新估算、轮廓走样。明白这一点,后面的办法就有了指向:不是继续加词,而是给模型留下能反复参照的东西。
办法一:先定一张标准像,后面每张都拿它当参照
先单独生成或挑出一张最满意的图,把它定为这个角色的标准像:正脸或微侧、光线均匀、没有重滤镜和夸张表情,五官和发型看得越清楚越好。之后工具如果提供参考图、角色参考或垫图一类的入口,就把标准像传进去再写新场景,模型有了具体的脸可抄,一致性会比纯文字描述高一个档次。参考强度别拉满:太高容易把姿势和构图一起复制过来,新图只剩换背景;太低又压不住漂移,从中间值开始试。工具没有参考图功能时,退一步用同一会话里的上一张成图做图生图修改,不要每次都从纯文字重新生成。
办法二:把长相写成固定清单,每次原样复制
把角色的长相拆成一份不变的清单,存下来,每次生成原样粘贴,只改后面的场景部分。清单写这几项就够了:年龄感、脸型、发型发色和分缝、眉眼特征、一个标志物(眼下痣、细框眼镜、固定耳饰)、默认服装的款式和主色。比如“28岁左右,圆脸,黑色齐肩波波头、中分,左眼下有一颗小痣,戴细框眼镜,常穿红色夹克”,这一串就是角色的锚点,场景再怎么换,锚点一个字不动。最忌讳每张图随手改写描述:这张写“长发披肩”,下张写“及肩发”,在你看来差不多,在模型那里就是两个发型,脸也会跟着偏。表情、动作、地点、天气都放在清单之外单独换,一次只换一两处。
办法三:种子能锁就锁,改图优先于重新生成
不少工具会显示或允许填写种子(seed),可以把它理解成这次抽图的编号:种子、提示词和参数都相同时,结果能大体复现。所以定下标准像时顺手记下它的种子,后续图沿用同一个种子再小幅改动场景词,脸会比随机种子稳一些。但种子锁的是抽图起点,不是人脸档案,场景词改动一大人物还是会漂,只能当辅助。更稳的做法是改图优先:新的一张尽量从上一张满意的成图出发,用图生图或编辑方式换服装、换背景、换动作,让脸在原图基础上延续。改动时一次只动一个变量,真出了问题也知道是哪一步弄丢的。
办法四:已经漂移的图用局部重绘救,护住脸别整张重抽
一组图做到后半程,难免有脸对了衣服不对、或场景对了脸走样的图。这时别整张重抽,那等于把对的部分也一起赌掉。用局部重绘(inpainting)把要改的区域涂出来重画:衣服错了只涂衣服,背景乱了只涂背景,脸部区域尽量不动——直接重绘脸部,画出来的基本就是另一个人。反过来,脸已经明显不是同一个人的那张,局部修补救不回来,趁早淘汰重做。同批出图可以多抽几张挑最像的入选,最后统一色调和画风词收尾,成组观感会比逐张死磕一张更稳。
用真人照片当参照,先把授权和边界弄清
参照不一定非用生成图,也有人想拿真人照片定角色,这里先把边界说清:用自己的照片问题不大;用别人的照片,哪怕公开能搜到,也涉及肖像和隐私,没有明确同意不要拿来批量生成,更不能生成足以冒充本人的内容;未成年人的照片不要上传到来历不明的工具。打算商用时,再看一遍工具服务条款里对生成内容使用范围的说明,别等做完整套图才发现授权口径不对。把标准像原图、长相清单和用过的种子存成一份角色档案,下次开新系列直接调用,人物就不会每换一个项目就换一张脸。