
AI生图最让人头疼的,不是把图做出来,而是让同一个人反复出现时还像同一个人。今天是清爽短发,明天五官就变了;上一张像本人,下一张像“长得差不多的路人”。如果你正在做头像、角色设定、短视频封面、虚拟人设或系列海报,稳定人物一致比单张出图更重要。
好消息是,这件事并不只靠运气。只要把“参考图、提示词、参数、后期修正”四件事串起来,新手也能把同一张脸稳住。用机灵助手这类支持参考图和多轮生成的工具时,流程会更顺,少走很多弯路。

先说一个最容易踩的坑:很多人以为“只要把同一个名字写进提示词,人物就会固定”。其实不行。模型并不认识你写的名字,它更在意的是图像里的视觉特征。想稳住人物,需要让模型反复看到同一组“身份特征”,而不是只看到一个称呼。
真正影响一致性的,通常是这几类信息:
- 脸部结构:脸型、下颌线、鼻梁、眼距、眉形。
- 外观标记:发型、发色、刘海、痣、耳饰、胡子、眼镜。
- 穿搭轮廓:常穿的衣服版型、领口、配饰风格。
- 拍摄条件:角度、光线、镜头焦段、背景复杂度。
也就是说,想保持人物一致,不是“把画面画漂亮”,而是“把身份信息固定下来”。
先别急着写长提示词,先把参考图选对
很多一致性翻车,不是模型不行,而是参考图本身就不适合做身份锚点。选图时,优先用清晰、正脸、无遮挡、光线均匀的照片。理想状态下,脸部轮廓和五官能看得很完整,别让头发、手、墨镜、夸张表情挡住关键特征。
如果你手里只有自拍,也可以先做整理。挑一张最能代表这个人的图,再补两三张不同角度的图,形成一个小参考组。别一上来就拿妆容太重、滤镜太狠、表情太夸张的图去喂模型,那样模型学到的往往是妆效和光影,不是脸。
更实用的做法是,把参考图分成三类:
- 主身份图:最清楚、最像本人、正脸或轻微侧脸。
- 补充角度图:左侧脸、右侧脸、微笑、闭嘴等。
- 风格图:你希望之后统一使用的发型、服装、色调。
机灵助手里如果支持上传多张参考图,建议先把身份图和风格图分开管理。身份图只负责“像谁”,风格图只负责“像什么气质”,别让它们互相抢戏。
一张图不够,三张图更稳
单张参考图能用,但稳定性有限。尤其是要做连续三五张图、不同姿势、不同场景时,最好准备 3 张以上的统一人物图。选图原则是“像同一个人,但信息互补”:一张正脸,一张半侧脸,一张表情自然的近景。
这样做的好处是,模型不会把某一个角度误当成人物全部特征。比如有人只有侧脸照片,模型可能把鼻子、下巴、眼睛比例猜错;如果再补一张正脸,它就更容易把身份锁定住。
提示词别写成散文,得像在交代拍摄要求
想让人物一致,提示词里最重要的不是堆形容词,而是明确“保留什么、不要什么、变化范围多大”。很多新手会写一大串“漂亮、精致、高级、电影感、氛围感”,结果人物还是变。原因很简单:这些词只是在控制风格,不是在锁身份。
更有效的提示词结构,通常可以这样写:
- 身份部分:保留脸型、五官比例、发型、发色、皮肤状态。
- 场景部分:指定在什么环境、做什么动作、什么镜头。
- 限制部分:不要改变年龄感、不要夸张美颜、不要重塑五官。
- 风格部分:统一光线、色调、服装风格。
比如,不要只写“生成一个年轻女孩写真”,而要写成更可执行的表达:请根据参考图生成同一位人物的室内人像,保留原有脸型、眼睛大小、鼻梁和嘴唇比例,保持短发、自然黑发、干净皮肤质感,不要改变年龄感和五官结构,允许更换背景和服装,但人物识别度必须保持一致。
这种写法的核心,不在于文采,而在于边界清楚。模型知道哪些能动,哪些不能动,出图才更稳定。
负面提示词要用,但别写太虚
很多人会漏掉负面提示词,结果模型自动给你加上双眼皮、尖下巴、欧式鼻、过度磨皮,人物一下就跑偏了。负面提示词的作用,就是告诉模型不要往哪些方向乱补。
对于人物一致性,常见的负面方向可以包括:
- 不要改变脸型
- 不要夸张瘦脸
- 不要改变五官比例
- 不要过度磨皮
- 不要明显换发型
- 不要添加眼镜、帽子、遮挡物
- 不要双重五官、不要多余牙齿、不要畸形手部
但也别把负面词写成一长串无重点清单。写得太多,模型反而不知道真正该躲什么。优先写和你这张脸最相关的限制,比如“不要改变脸型、不要改变鼻梁长度、不要改变刘海和发色、不要夸张修图”。
如果你发现模型总爱把某个人画成偏成熟或偏幼态,也可以直接在负面提示词里补上“不要增加年龄感”或“不要弱化成熟轮廓”。
参数里最该注意的,其实是随机性
同一个人能不能稳定出来,很多时候不取决于“画得有多好”,而是“随机得有多少”。随机性越大,脸就越容易漂。你不需要把所有参数都背熟,但至少要知道哪些东西会明显影响一致性。
如果工具支持种子值,先固定种子。种子就像随机起点,固定后模型更容易沿着同一条路径出图。你可以先用同一组提示词和参考图,试 3 到 5 次,观察哪张最像,再把这组参数保存下来继续微调。
如果工具支持参考强度或图像权重,人物一致性场景一般不要太低。太低时,模型会“参考了,但没认真参考”;太高时,又可能把姿势和构图都钉死,导致图像没变化。比较稳的思路是:先让身份权重高一点,风格权重中等,再根据场景慢慢调。
还有一个容易被忽略的点是分辨率。低分辨率会让五官细节丢失,模型只能瞎补,自然就不稳定。尽量用清晰原图,输出尺寸也别太小。人物脸部如果本身就糊,后面再怎么修都很难真正统一。
在机灵助手里做测试时,建议你每次只改一个变量。比如先固定参考图和提示词,只改种子;再固定种子,换背景;再固定背景,换服装。这样你能很快判断,到底是哪个环节在把脸带偏。
同一张脸想换动作,最好分两步走
新手常犯的错误,是一次性要求“同一个人、全身、复杂动作、复杂背景、强烈光影、还要换服装”。结果模型为了完成场景信息,牺牲了身份信息。人物一致性越强,单次任务就越不适合贪多。
更稳的流程是先定人,再定景。第一步先生成一张最稳的身份照:半身、正脸、自然表情、背景简单、光线均匀。等这张脸稳定下来,再用这张图做下一轮变化,比如换场景、换姿势、换服装。
这就像做连续剧角色定妆,不是先拍爆炸场面,而是先把主演的脸拍准。只要第一张身份图足够稳,后面延展的难度会低很多。
如果你是做角色系列图,可以先固定这些要素:
- 发型不变,最多微调刘海和蓬松度
- 脸型不变,别让模型乱改下颌线
- 配饰不变,耳饰、项链、眼镜尽量保持一致
- 色调不变,冷暖不要每张都反转
动作可以变,但尽量别让动作挡住脸。比如大幅度低头、回头、撩头发、捂脸、侧脸遮挡,都会增加身份漂移概率。
换风格可以,别把身份和风格混成一团
不少人以为“换风格”就是“换脸”,其实完全可以把两者分开。身份是固定的,风格是可变的。你可以让同一个人出现在证件照风格、杂志封面风格、街拍风格、插画风格里,但前提是先把脸的核心特征稳住。
一个很好用的思路是,把提示词分成两层:外层写风格,内层写身份。身份层尽量短、具体、稳定;风格层可以灵活调整。比如“同一位人物、保留短发和圆润脸型”是身份层,“高级冷调、浅灰背景、柔光、轻微颗粒感”就是风格层。
如果你使用机灵助手做风格迁移,别一次上太多风格词。你说越多,模型越容易顾此失彼。先把人物稳住,再逐步增加“胶片感、时尚感、商务感、日系感”这类风格元素,成功率会高得多。
妆容和发型也会偷偷改脸
有些人以为脸变了,其实是妆发变了。高光打得太重、修容过深、睫毛过浓、刘海遮得太多,都会让身份识别变差。尤其是女性角色,发型变化对人物一致性的影响非常大,短发和长发几乎是两个不同的人。
如果你想稳定一个角色,优先固定发型轮廓。比如始终保持齐刘海、低马尾、侧分短发,哪怕衣服换了,脸还是容易被认出来。妆容则建议控制在“自然、轻度修饰”的范围内,别每张图都换成完全不同的眉形和唇色。
局部重绘比整张重抽更省事
当你已经有一张差不多的人物图,但眼睛、嘴角、发际线、耳朵有点跑偏时,别急着整张重抽。先用局部重绘修正,效率通常更高。因为整张重抽会把已经对的部分也一起打乱,越改越不像原人。
局部重绘时,思路是只改小范围,不动核心识别区。比如:
- 眼睛太圆,就只修眼型,不改整张脸。
- 嘴型不对,就只修嘴角和唇峰。
- 发际线乱了,就只修头发边缘。
- 耳饰不一致,就只替换配饰区域。
如果工具允许,你还能把重绘区域缩到最小。范围越小,身份漂移越少。很多人重抽十几次都不满意,其实换成局部修正,一两次就够了。
这一步在机灵助手这类支持二次编辑的工具里尤其好用。先把“最像本人”的版本留住,再针对细节做小改动,比反复重来更容易保住同一张脸。
想做系列图,就先建立自己的角色卡
如果你不是只做一张图,而是要长期生成同一个人,建议干脆给这个角色做一张小卡片。卡片里不用写得复杂,但要把最关键的信息固定下来。以后每次出图,都从这张卡片出发,而不是凭感觉临时拼提示词。
角色卡可以包含这些内容:
- 年龄感:青年、成熟女性、少年感等
- 脸部特征:脸型、眉眼、鼻子、嘴唇
- 发型特征:长度、刘海、发色、分缝
- 标志物:痣、眼镜、耳饰、帽子
- 服装基调:通勤、休闲、运动、轻正式
- 常用色调:冷白、暖黄、低饱和、胶片感
这样做的好处是,你以后换平台、换工具、换模型,也能带着同一套角色信息走。机灵助手如果支持保存模板,直接把这套角色卡沉淀成自己的专用模板,会省很多时间。
最容易被忽略的一步,是先做“像本人”的基准图
很多人一上来就追求“好看”,结果把人物改得过度精致,反而失去原本的识别度。更稳的顺序,是先做一张“像本人”的基准图,再慢慢优化审美。基准图的任务不是惊艳,而是准确。
判断一张图是不是适合当基准图,可以看三点:
- 朋友一眼能认出来是谁
- 五官没有明显漂移
- 发型、脸型、气质都保留住了
如果这三点都满足,这张图就值得保存下来,作为后续所有生成的锚点。后面不管是换衣服、换背景,还是做海报、头像、封面,都围绕这张图展开,成功率会高很多。
你会发现,AI生图里“同一张脸”并不是高深技巧,而是一个很朴素的控制过程:选对参考图、把身份信息写清楚、减少随机性、必要时用局部修正。做熟之后,人物一致性会越来越稳定,出图也会越来越省心。
真正好用的方法,往往都不花哨。把人物锁住,风格才有发挥空间;脸先稳了,故事感、商业感和系列感才会跟着出来。对新手来说,先把这一关过掉,后面的AI生图才算真正进入可控状态。










