
AI人物脸老是变,先别急着换模型
很多人第一次用 AI 生成人物图时,都会遇到同一个问题:同一张脸,第二次就不像了,第三次甚至像换了人。问题不一定出在模型本身,更多时候是输入信息不够稳定,或者角色特征没有被固定住。只要把提示词、参考图和细节控制做好,人物一致性会明显提升。
这件事尤其常见在做头像、角色设定、连载漫画、短视频封面和故事插图时。人物脸不稳定,会让整组图看起来像“同名不同人”,后续做系列内容也很难统一。想解决它,思路不是“多抽几次”,而是让 AI 每次都拿到同一套识别线索。
先搞清楚,为什么脸会飘来飘去
AI 生成人物时,本质上是在根据文字、图像参考和概率去补全细节。如果你给的线索太少,它就会自己发挥;如果线索互相打架,它也会改来改去。人物脸不一致,常见原因有四个:提示词太泛、参考图不稳定、风格词干扰身份、重绘参数波动太大。
比如你写“年轻女生、漂亮、干净、温柔、电影感”,这类描述几乎适合所有人,模型很难锁定某一张脸。再比如你前一张图用了正脸自拍,后一张图换成侧脸、强光、戴帽子、表情夸张,模型识别到的信息就完全不同。还有一种情况是风格词太强,漫画风、赛博风、油画风会把原本的面部结构重新塑形,最后看起来像“同发色不同人”。
把人物信息写成“固定档案”,比写形容词更有用
要让 AI 记住一个人,别只写感觉,要写能辨认的结构。最实用的做法,是先给角色做一份固定档案:年龄段、脸型、眉眼位置、鼻梁特点、嘴唇厚薄、发型、发际线、标志性配饰、常穿颜色。这样 AI 每次生成时,识别依据更明确。
可以把提示词组织成“身份 + 外貌 + 服装 + 场景 + 风格”的顺序。比如:
示例:“25岁亚洲男性,短黑发,额前自然分缝,窄双眼皮,鼻梁直,嘴唇偏薄,左眉尾有一颗小痣,穿深蓝色连帽外套,半身正面,室内自然光,真实摄影风格,面部清晰,五官比例稳定。”
这样的写法比“帅气、清爽、阳光”更稳定,因为它给了模型足够多的身份锚点。你也可以把这些信息保存成一份固定模板,每次只替换场景,不要频繁改人物骨架。
参考图别乱传,选对素材比加十条提示词都管用
如果你上传的是参考图,素材质量直接决定人物能不能锁住。最稳的参考图,通常满足几个条件:正脸或轻微侧脸、脸部无遮挡、光线均匀、清晰无强滤镜、背景不抢戏、五官分辨率足够。尤其是眼睛、鼻子、嘴角这些位置,最好能看清楚边界。
人像图里最容易出问题的是这些:帽檐压脸、刘海挡眉、手遮下半脸、口罩、过强美颜、逆光过曝、磨皮太狠。它们会让模型判断五官时丢信息,后面无论怎么生成,都容易“换脸”。如果你是做系列角色,最好准备 3 到 5 张统一风格的参考图:一张正脸、一张轻侧脸、一张半身、一张全身、一张带典型表情。这样比只靠一张图更稳。
如果你用的是机灵助手这类支持多轮出图的工具,参考图越统一,后续改场景时脸也越不容易跑掉。很多人以为是模型不行,实际上是输入图本身就没把人物说清楚。
提示词里最该固定的,不是风格,是脸部特征
很多提示词写得很长,风格词一大串,真正有用的却很少。想让脸稳定,最重要的是把“可识别的脸部特征”放在前面,而且尽量保持每次一致。比如固定脸型、眉形、眼型、鼻型、唇形、发型、痣、雀斑、酒窝、耳饰、发际线,这些比“高级感”“氛围感”更能帮助锁脸。
可以试试下面这种结构:
- 人物身份:年龄、性别、气质
- 脸部特征:脸型、眉眼、鼻唇、痣、发型
- 构图信息:正面、半身、近景、全身
- 场景信息:室内、街头、校园、夜景
- 风格信息:写实、电影感、插画感、漫画感
示例:“23岁女生,鹅蛋脸,单眼皮,眼尾微微上挑,鼻梁小而直,嘴唇偏薄,左脸颊有浅雀斑,黑色长发中分,发尾微卷,穿米白色毛衣,正面半身,干净背景,柔和自然光,写实摄影风格,人物五官稳定,面部清晰。”
如果你每次都要生成同一个角色,可以把这段提示词固定下来,只有场景和动作变化。这样 AI 识别的不是“一个差不多的人”,而是“同一个人换了姿势和环境”。
负面提示词要用对,别让模型偷偷改脸
负面提示词不是越多越好,但用对了很关键。很多脸不稳定的问题,实际上是被一些默认倾向带偏了,比如卡通化、过度美颜、面部模糊、五官变形、左右脸不一致、种族漂移、嘴巴遮挡等。把这些风险提前排掉,能减少很多返工。
常用的负面方向可以集中在几类:
- 身份漂移:变成其他人、面部身份不一致、五官改变
- 五官失真:眼型改变、鼻子改变、嘴唇改变、脸部模糊
- 画面质量:低分辨率、压缩伪影、低细节、过度磨皮
- 遮挡干扰:口罩、围巾遮住嘴巴、头发遮挡脸部
- 结构错误:重复面孔、多余肢体、手部变形
如果你想保留真实感,负面词里还可以加入“卡通、动漫、插画、CGI、娃娃脸”,防止模型在不知不觉中把人改得过于二次元。反过来,如果你就是要做漫画化角色,也要注意别让风格词把身份压没了,这时候就要在主提示里把脸部特征写得更硬一点。
一张参考图不够时,怎么让同一张脸连续出现
如果你要做系列图,单张参考图通常不够稳,尤其是姿势变化大、表情变化大、镜头变化大时。更靠谱的做法是建立“角色包”:固定的正脸头像、半身照、全身照、典型表情照、服装基准图。这样每次生成时,模型不是只看一个片段,而是综合多个角度去理解这个角色。
还有一个很有效的技巧,是先做“角色基准图”,再基于这张图去变场景。也就是说,不要每次都从零生成。先把人物脸调到最满意,再把这张图作为后续生成的参考。很多工具都支持这种工作流,机灵助手做系列内容时就很适合先定角色,再换动作、换背景、换光线。
如果你在做漫画分镜,也可以把主角固定成同一套设定,再让表情和服装轻微变化。分镜里最怕的不是风格不同,而是第一格和第三格像两个陌生人。角色统一后,故事感会自然很多。

想更稳,先把镜头和表情控制住
很多人会忽略一个事实:镜头和表情对脸的影响非常大。大笑、夸张张嘴、仰拍、俯拍、广角特写,这些都会改变脸型和五官比例。你以为是“换脸”,其实是镜头变形导致的识别偏差。所以,如果目标是稳定人物,一开始尽量先用中性表情、正面视角、常规焦段。
最稳的测试顺序通常是:正面静态头像 → 半身正面 → 轻微侧脸 → 轻表情 → 动作姿势。不要一上来就要求大幅度动作、侧身回头、夸张情绪、强透视。先把“基础脸”做稳,再加戏,成功率会高很多。
如果你在机灵助手里反复试图锁脸但总飘,先把“动作”“镜头语言”“表情强度”降低一级,常常比盲目加提示词更有效。AI 不是不懂你想要什么,而是你一次给它的变化太多,它只好自己补。
风格可以换,但别把角色骨架换掉
很多人会问:既然人物不一致,是不是因为风格太多?答案是,风格本身不是问题,问题是风格遮住了身份。换句话说,风格可以变成写实、插画、手绘、动画海报,但人物骨架最好保持一致。脸型、眉眼距离、鼻唇关系、发型轮廓不要乱动,风格才有基础。
比如同一个角色,想做写实头像和动画海报,你可以这样分层:身份特征固定,风格层单独替换。写实版本强调光影和皮肤细节,动画版本强调轮廓和色块,但人物的识别点不变。这样即便风格跳变,观众也能一眼看出是同一个人。
有些场景还可以借助更明确的风格描述,比如“半身构图”“电影感光影”“清透肤色”“线条干净”“角色设定图”“现代动画概念美术”。这些词的作用不是让模型随便发挥,而是帮助它在统一身份的前提下做风格迁移。
几个好用的实战模板,直接改就能上手
下面这些模板不追求华丽,核心是稳定。你可以把人物部分替换成自己的角色信息,再把场景替换成需要的内容。
写实头像模板:“28岁亚洲女性,鹅蛋脸,单眼皮,眼尾微扬,鼻梁小而直,嘴唇自然偏薄,黑色长直发,中分,左脸颊一颗小痣,正面近景,纯色背景,自然光,真实摄影风格,面部清晰,五官一致性高。”
故事插图模板:“同一角色,25岁男性,短黑发,窄双眼皮,眉骨清晰,穿深色外套,站在雨后的街道边,半身构图,冷暖对比光线,电影感,角色身份稳定,面部特征清楚。”
漫画角色模板:“固定角色设定,亚洲女生,圆润脸型,齐刘海,黑长发,发尾微卷,左眼下方有小痣,表情平静,半身构图,线条干净,色彩简洁,日系漫画风,人物辨识度高。”
如果要批量做内容,可以在每次生成前只改三项:场景、动作、情绪。其余部分尽量锁死。这样你会发现,出图稳定很多,后期筛图也轻松得多。
别只盯着出图那一刻,后期微调才是真正省时间
AI 图不是一次就要完美。人物脸稳定到 70 分,后期微调到 90 分,往往比追求一次成品更现实。你可以把最接近目标的图先存下来,再针对性修:轻微调整眼距、嘴角、发型边缘、耳饰、肤色和光影方向。如果工具支持局部重绘,就只改问题区域,不要整张图推倒重来。
当你发现人物总是“差一点像”,不要急着把提示词写成巨长的清单。先看问题到底是身份没锁住,还是构图变了,还是风格太强。多数情况下,改一处关键细节就够了。把“脸型+眉眼+发型”固定好,再控制参考图质量和负面词,人物一致性通常会明显改善。
做得多了会发现,AI 生图最重要的不是词越多越厉害,而是每次都给模型同样明确的身份锚点。会写提示词的人,常常不是堆词最多的人,而是最懂得删掉干扰项的人。机灵助手这类工具之所以好用,也在于它能让你更快试出哪些信息真正影响脸,哪些只是噪音。
如果你的目标是连续出同一个人物,建议先把角色档案整理好,再准备两三张高质量参考图,最后用固定模板反复测试。脸一旦稳定,后面的场景、服装、情绪和故事感才有机会真正展开。










