
很多人第一次写人物提示词,都会卡在“感觉写了很多,但图还是不对”。其实人物类提示词并不神秘,关键不是堆形容词,而是把人物、环境、光线、镜头和风格说清楚。只要结构对了,人物写真和场景照都能套用。
更实用的做法,是先把提示词拆成几个稳定模块,再按需求替换内容。这样写出来的句子既好改,也方便批量测试风格。无论你是在做头像、写真、旅行照,还是带人物的故事场景,都能用同一套思路去组织。

先别急着写长句,先把人物说清楚
人物提示词最核心的部分,是先定义“谁在画面里”。这一步越具体,模型越不容易乱猜。别只写“一个女生”或“一个男生”,最好连年龄感、气质、发型、服装、姿态都交代一下。比如“25岁左右的亚洲女性,短发,黑色高领毛衣,坐姿,眼神安静”就比“漂亮女生”稳定得多。
如果你有参考照片,人物描述要尽量贴近原图特征;如果是从零生成,则重点放在风格统一和审美方向上。像“清冷感”“文艺感”“高级感”这类词可以用,但最好搭配可见细节,比如服装材质、妆面浓淡、表情状态,不然容易变成空话。
人物部分常用的顺序可以是:
- 年龄感、性别、种族或肤色倾向
- 发型、妆容、服装、配饰
- 表情、动作、视线方向
- 人物气质或情绪关键词
比如你想做一张干净的个人写真,可以写成:“一位20多岁的亚洲女性,长直发,浅色衬衫,轻微侧身站立,目光看向镜头外,表情克制安静,整体气质清爽自然。” 这样比只写“清冷美女写真”要稳很多。
场景别写成大杂烩,给画面一个明确地点
人物照和场景照的差别,往往就在“环境是否有效”。人物写真可以把背景压到很弱,但场景照不能没有地点感。比如街头、咖啡馆、卧室、办公室、海边、雨夜路灯下,这些都是能帮助模型理解空间关系的关键词。
场景描述不需要写得像小说,重要的是把“地点 + 时间 + 氛围 + 物件”说到位。比如“傍晚的城市天台,远处霓虹灯虚化,风轻轻吹动衣角,地面有微弱反光”就能让画面更完整。相比之下,“都市感场景”太笼统,模型容易生成泛化背景。
如果你想做带人物的场景照,建议把场景和人物关系一起写出来。比如“坐在窗边看书的女孩”“雨天便利店门口撑伞的男生”“火车站台边拖着行李的人”,这种“动作 + 地点”的组合,比单独写景更容易出故事感。
这里有个很实用的经验:场景只写一个主地点,最多再补一个辅助空间。比如“咖啡馆内,窗外是模糊街景”就够了;如果同时写“咖啡馆、海边、地铁站、屋顶”,画面往往会互相打架。
光线和镜头感,才是出片稳定的关键
很多提示词看起来内容不少,结果图还是平,因为少了光线和镜头信息。人物生成很吃“拍摄感”,所以最好把光源、色温、景深、镜头类型一起写进去。它们不一定要专业,但要让模型知道你想要什么样的成片。
常见的写法包括:自然窗光、逆光、侧光、柔和漫射光、霓虹灯光、伦勃朗布光、电影感低照度、浅景深、背景虚化、35mm镜头、85mm人像镜头、胶片质感。这些词不用全塞,选两到四个最有效。
比如想做影楼感写实写真,可以这样写:“柔和棚拍光,背景简洁,85mm人像镜头,浅景深,皮肤质感真实,眼神光明显。” 这类描述对“像不像照片”影响很大。要是想做氛围场景照,则可以加上“黄昏自然光”“雨后反光地面”“街灯形成高光边缘”等信息。
如果你在用机灵助手这类工具整理模板,建议把光线单独做成可替换段落。因为同一个人物设定,换一组光线,照片气质会差很多。白天清透、夜景冷感、棚拍高级,往往只差这一段。
风格词别乱堆,先选一个主方向
风格词是最容易写废的地方。很多人一口气写“写实、电影、胶片、时尚、赛博、油画、纪实、国风”,结果模型不知道该往哪边靠。更稳的方式,是先定一个主风格,再用少量辅助词修饰。
人物写真常见的主风格有几类:
- 写实摄影:强调真实皮肤、自然光、照片质感
- 影楼精修:强调干净背景、轮廓清晰、商业人像效果
- 胶片感:强调颗粒、低饱和、复古色调
- 电影感:强调情绪、构图、光影层次
- 时尚杂志感:强调造型、姿态、干净利落的商业审美
风格词最好放在人物和场景之后,作为整体收束。比如“亚洲女性,黑色连衣裙,站在落地窗前,黄昏自然光,电影感写真,低饱和,细腻肤质,画面安静高级”。这里的风格是收尾,不是开头一股脑全扔进去。
如果你做的是场景照,也一样要先想清楚风格方向。比如同样是“便利店夜景”,你可以做成纪实摄影、动画分镜、日系清新、赛博霓虹四种完全不同的结果。风格一旦统一,提示词才会更像“模板”,而不是临时拼句子。
一个好用的通用模板,先照着抄
人物提示词不必从零发明。更稳的做法,是直接用固定骨架,再换变量。下面这套结构,既适合人物写真,也适合带场景的图片:
主体 + 人物特征 + 动作表情 + 场景地点 + 光线环境 + 镜头构图 + 风格关键词 + 画质要求
把它展开后,可以写成:
“一位[年龄/性别/气质]的人物,[发型/服装/妆容],[动作或姿态],[表情与视线],位于[具体场景],[时间/天气/光线],使用[镜头/景深/构图],整体呈现[主风格],细节真实,画面干净,高质量。”
这个模板最大的好处,是每一段都有明确任务。人物负责“谁”,场景负责“在哪”,光线负责“怎么看起来像拍的”,风格负责“像什么类型的成片”。少了任何一块,效果都会打折。
如果你平时用机灵助手整理提示词库,也可以直接把这套结构做成可复用模板。先保存人物、场景、光线、风格四类常用片段,再根据项目拼接,比每次手写高效很多。
人物写真怎么写,重点放在“人像质感”
写真类提示词的目标,通常不是讲故事,而是把人物拍得好看、干净、统一。所以这类提示词要更注意“脸、皮肤、姿态、衣着、背景”之间的平衡。最常见的问题是背景太抢,或者表情太僵,导致像一张被元素堆满的海报,而不是人像。
比较稳的写真提示词,会把注意力放在这些细节上:
- 脸部特征:五官清晰、肤质自然、妆容轻重
- 姿态:站姿、坐姿、回头、侧脸、低头
- 衣着:纯色、针织、衬衫、西装、连衣裙
- 背景:干净、浅色、虚化、室内自然光
- 成片要求:高分辨率、真实摄影、细腻层次
例如这条可以直接试:“一位25岁左右的亚洲女性,黑色长发,浅米色针织上衣,微微侧身站立,表情安静自然,背景是简洁的室内空间,柔和窗光从侧面打亮脸部,85mm人像镜头,浅景深,真实摄影风格,细腻皮肤质感,高清成片。”
如果你想要影楼感,可以再加“背景纯净、轮廓光明显、服装更正式、姿态更端正”;如果想要生活感,则可以把“微笑、眼神放松、自然站姿、普通室内光”作为主方向。写写真时,最重要的是别让画面太杂,人物本身要永远是第一主角。
场景照怎么写,重点放在“氛围和关系”
场景照比写真更依赖叙事感。画面里的人物不只是“好看”,还要和环境发生关系。你可以把人物当成场景的一部分,写出动作和空间互动,比如“倚靠窗台”“站在路灯下”“坐在车站长椅上”“拖着行李走过街口”。
场景类提示词要关注三个层次:远处有什么、中景里有什么、人物在做什么。这样模型更容易组织空间。比如“雨天街道、路边霓虹招牌、地面反光、人物撑伞快步前行”,这类句子已经有了时间、地点、天气和动作,整体会更像一张完整的场景照片。
如果做故事氛围,可以把情绪写得更具体些。不要只写“伤感”,可以写“独自坐在车站长椅上,手里拿着旧票根,眼神望向远处,空气潮湿,灯光偏冷”。具体动作越清楚,画面越容易成立。
场景照的风格也不宜过多。如果想做电影感,优先写“低饱和、对比适中、环境光明显、构图留白”;如果想做旅行记录感,就写“自然光、真实路人感、轻微抓拍、不刻意摆拍”。风格清楚了,人物和空间才会统一。
想让人脸稳定,几个词最好少用
人物生成里,有些词看起来很美,其实对稳定性帮助不大,甚至容易让画面跑偏。最典型的是那种过于抽象、没有可见细节的词。比如“高级”“氛围拉满”“绝美”“超有感觉”,这些词几乎不能直接告诉模型要画什么。
另外,堆太多风格词也会干扰人脸稳定。比如一边要求“写实摄影”,一边又写“插画感、二次元、油画棒、漫画线条”,模型就会在不同视觉系统之间摇摆。人物提示词最好保持单一方向,尤其是头像和写真场景。
还有一个容易忽略的问题,是过度描述背景元素。人物类图片里,如果你一口气加入太多道具、建筑、天气、光效,模型很容易把重点从脸转移到环境上。更稳的策略是先保证人物好看,再逐步加复杂场景。
如果是用机灵助手之类的模板工具,建议把“基础人像模板”和“场景增强模板”分开。先出纯人像,再在稳定结果上叠加场景,通常比一开始就把所有元素塞满更容易成功。
直接能用的几条模板,改几个词就行
下面这些模板可以直接复制,再按你的需要替换括号里的内容。它们的结构都比较稳,适合先跑通,再微调。
写真模板 1:“一位[年龄]岁的[性别],[发型],[服装颜色和款式],[动作姿态],表情[情绪],背景为简洁的[场景],柔和自然光,85mm人像镜头,浅景深,真实摄影风格,皮肤质感细腻,画面干净,高质量。”
写真模板 2:“[人物设定],站在[地点],[时间]的[光线]照在脸上,眼神看向[方向],整体气质[关键词],构图以人物为中心,背景轻微虚化,电影感,人像摄影,色彩克制,高清。”
场景模板 1:“一位[人物设定]在[具体地点],[动作],[天气/时间],周围有[少量关键物件],画面氛围[情绪],自然光或路灯光,纪实摄影风格,空间层次清晰,真实感强。”
场景模板 2:“[人物]与[场景]形成互动,[前景/中景/远景]层次分明,[光线]制造明显边缘光,画面具有[风格]气质,低饱和或高对比,细节丰富,适合故事感海报。”
这些模板真正有用的地方,不在于句子本身,而在于你能快速替换变量。人物、服装、地点、光线一变,图就会跟着变。多试几轮之后,你会很快摸到哪一段最影响结果。
怎么改才更像你想要的图
提示词不是写一次就完事,而是需要“局部调参”。如果图里脸不稳,先改人物描述,减少矛盾词;如果背景太乱,删掉多余场景物件;如果不够像照片,就补镜头和光线;如果风格漂移,就收紧主风格,不要同时追求太多效果。
一个比较有效的调试顺序是:
- 先定人物设定
- 再定场景地点
- 补光线和镜头
- 最后写风格和质感
这样调出来的提示词更容易稳定复用。你也可以把成功案例保存成模板,下次只替换人物年龄、衣服颜色、地点和氛围。用得久了,会发现真正决定出图质量的,不是你会不会写长句,而是会不会把信息分层。
人物写真和场景照其实是同一套方法的两个分支。一个更重视脸和质感,一个更重视空间和氛围。只要你把“谁、在哪、怎么拍、像什么”这四件事交代清楚,AI 图像生成就会稳定很多。剩下的,就是不断用模板试、改、存,把常用风格慢慢积累成自己的提示词库。像机灵助手这类工具,适合做这件事:把常用模板整理好,出图时直接调用,省得每次从头想。










