
先把“构图不跑偏”这件事说透
很多人用 AI 生成图,最常见的挫败不是画不出来,而是“像了,但构图变了”。人物站位偏了,主体被裁掉了,前景后景顺序乱了,原本想保留的透视关系也被重新排布。问题往往不在模型“不会画”,而在指令里没有明确告诉它:哪些东西必须沿用原图,哪些地方可以自由发挥。
要想让 AI 尽量保持原图构图,思路不能只盯着“风格”。真正要管住的是画面骨架:主体位置、视角高度、画幅比例、前后层次、留白方向、光源方向和裁切边界。只要这些信息传达清楚,模型就不容易乱改版式。
这类任务很适合在 机灵助手 里做,因为它通常能把参考图、提示词和局部修改放在同一个流程里处理,适合先出草图,再逐步锁定构图。做海报、头像、商品图、漫画分镜时尤其省时间。

先认清:哪些信息最影响构图
AI 不是按“文字顺序”理解画面的,它更像是在综合识别几类约束。只要你能把这几类说清楚,原图构图就更容易保住。
- 主体位置:人物在左、右、中间,商品是居中还是偏下。
- 视角关系:俯拍、平视、仰拍,或者略带侧前方角度。
- 画幅比例:1:1、3:4、4:5、16:9,不同比例会直接影响裁切。
- 层次顺序:前景遮挡、中景主体、背景元素是否稳定。
- 留白方向:海报文字区、人物视线方向、商品旁边空位。
- 光线方向:左侧补光、逆光轮廓、窗边自然光。
如果这些点没交代,模型常会自行“优化画面”,结果就是更好看但不再像原图。保持构图的核心,其实是减少模型自由发挥的空间。
提示词别写成风格作文,要写成“约束清单”
想保构图,提示词最忌讳空泛。比如“高级、氛围感、电影感”这些词可以有,但只能做补充,不能代替结构说明。真正有用的写法,是把构图要求拆成几个短句,像给画面下工单。
一个实用的顺序是:主体是谁,主体放哪,从什么角度看,背景保留什么,哪些元素不要改。这比单纯堆形容词稳定得多。
例如你想保留一张单人街拍的构图,可以这样写:
“保留原图构图,人物位于画面右侧三分之一处,半身构图,镜头平视,左侧保留街景留白,背景建筑轮廓简化,不改变人物朝向与手部位置,保持原始透视关系。”
这类提示词的重点不是好听,而是可执行。模型看到“右侧三分之一”“半身构图”“左侧留白”时,会更倾向沿用原版式,而不是重新拼一张新图。
几个常用的构图约束句式
下面这些句式可以直接拼进提示词里,用来提高构图一致性。
- 保留原图构图:原始主体位置、镜头角度、画幅比例尽量不变。
- 固定主体区域:主体保持在画面中心/左侧/右侧三分之一处。
- 锁定视角:平视、俯拍、低机位仰视,避免自动切换角度。
- 保留留白:左侧/上方保留文字空间,背景不要填满。
- 避免重构场景:不重新安排人物、道具与背景层次。
如果原图本身构图很好,最好明确写“尽量沿用原图版式”,而不是简单说“参考原图”。“参考”这个词太弱,模型通常会理解成“看一眼再重画”。
参考图怎么选,才能少走弯路
很多构图崩掉,不是提示词写错,而是参考图不适合拿来做“保构图”任务。参考图最好满足三个条件:主体明确、边界清楚、背景不过分复杂。越像一张“结构清晰的照片”,AI 越容易复现。
适合做参考的图,通常有这些特征:
- 主体不被严重遮挡,脸、手、商品轮廓清楚。
- 画面没有太多重叠元素,前后景层次分明。
- 光线方向统一,阴影不过度复杂。
- 画幅比例正常,没有极端裁切。
- 构图重心稳定,不是强透视、鱼眼或大幅运动模糊。
不太适合的情况也要避开:多人挤在一起、动作特别夸张、镜头畸变明显、背景元素太碎、边缘主体被裁掉一半。这样的图即使上传进去,模型也容易补画“自己认为合理”的版本。
如果你用的是机灵助手,建议先上传一张主体清楚的原图,再在提示词里强调“保持主体位置与镜头关系”。有时候只要把参考图换成更干净的版本,构图稳定性就会明显提升。
别只盯着大模型,参数也会偷偷改版式
不少人觉得构图跑偏是“模型不行”,其实和生成参数关系很大。尤其是画幅比例、重绘强度、随机性和参考图权重,这几项都会影响最终版式。
最先要检查的是画幅比例。原图如果是竖图,结果却用横图生成,模型必然会重新安排主体位置。保构图时,比例尽量贴近原图;如果需要换比例,也要先接受“边缘信息必然变化”这个现实。
其次是重绘强度。强度太高,AI 会把原图当成“灵感来源”而不是“版式模板”。想保留构图,第一轮建议控制在较低到中等范围,让模型主要做细节更新,不要大改结构。
随机性也很关键。随机性越高,模型越可能自发改构图。先用相对稳定的设置跑出一个接近的版本,再微调,比一上来就追求创意更有效。
如果工具支持参考图权重,尽量把权重给到足够高,但不是越高越好。太高会让图像风格呆板,细节跟着原图走得太死。比较稳的做法是:先锁构图,再调风格。
一套更稳的提示词顺序,照着拼就行
很多提示词之所以混乱,是因为把风格、构图、内容、细节要求全塞在一起。更稳的顺序应该是:先结构,再内容,后风格,最后加限制。这样模型会先看见“怎么摆”,再看见“画什么”,不容易反客为主。
可以按下面这个顺序组织:
- 第一层:构图结构,比如主体位置、视角、留白、比例。
- 第二层:主体描述,人物是谁、商品是什么、动作怎样。
- 第三层:场景环境,背景简化、室内/户外、时间氛围。
- 第四层:风格细节,写实、插画、漫画、胶片感、柔光等。
- 第五层:排除项,不要改构图、不要多人物、不要额外道具。
例如:
“保留原图构图,单人站在画面中央偏右,半身视角,背景是简洁室内空间,窗边自然光从左侧进入,整体为干净的写实摄影风,不增加第二个人物,不改变手势,不重新安排背景元素。”
这种写法看起来朴素,但在多数图像生成场景里都比“高级电影海报感、强烈氛围、梦幻色彩”更稳。构图任务最怕模糊词,越模糊,模型越自由。
人物图最容易翻车的几个点
人物构图保不住,常常不是脸变了,而是站位和肢体关系被改了。尤其是手部、腿部、头部朝向这几个位置,模型很容易自行重排。
想减少翻车,可以明确写:
- 人物保持同一朝向,不要左右反转。
- 手臂位置不变,避免新增夸张动作。
- 头部高度不变,不要把半身图改成全身图。
- 人物与背景的距离不要拉远或压近。
如果你在机灵助手里做人物二次创作,先保结构,再调服装和表情,成功率通常更高。很多人一开始就改发型、服饰、光影,结果模型顺手把构图也一起改掉了。
商品图和海报图,重点其实不一样
商品图的核心是“商品居中、轮廓清楚、比例稳定”,而海报图更看重“留白和视觉动线”。这两类图都要保构图,但侧重点不同。
商品图里,最重要的是商品轮廓、朝向和视角。比如杯子、鞋子、电子产品这类对象,位置稍微偏一点,产品信息就会显得不专业。提示词里最好写清楚“商品占画面主体区域的百分比”“主体与边缘的距离”“底座是否露出”等信息。
海报图则要提前想好文字区在哪边,人物视线朝向哪里,背景不要不会抢主体。很多海报翻车,不是主体画错,而是留白被填满,后续根本没地方放标题。保留原图构图时,最好直接写“左侧留出大面积空白用于排版”或“上方保留标题空间”。
如果你是做电商图,或者需要批量出主视觉,机灵助手这类工具的模板化流程会更方便:先找相近构图模板,再替换主体和场景,比从零开始让模型自由发挥稳定得多。这里和 AI生图工具 的常见思路一样,真正值钱的是“把可控项先定住”。
局部重绘比整张重做更适合改细节
很多时候原图构图已经差不多了,只是局部细节不满意,比如手太怪、衣服褶皱不自然、背景杂物太抢眼。这时不必整张重来,局部重绘更合适。
局部重绘的优点是,它默认保留大结构。你只需要把要改的区域圈出来,提示词只描述那一块的变化,构图就不容易被牵着跑。比如只改天空、只改桌面、只改衣服纹理,往往比全图重生成更稳。
局部重绘时有两个关键点:
- 圈选范围不要太大,否则模型会把相邻结构也一起改掉。
- 提示词只写局部目标,不要在局部修改时重新描述整张图。
如果你想让原图人物构图不变,只修脸部或服装,最稳的方式就是“少写、少改、少放大”。这和许多 AI提示词生图 场景一样,越集中越容易出结果。
三类常见场景,分别怎么保
不同场景的构图保法不一样,不能一套词走天下。下面这三类最常见,也最容易复用。
把照片改成漫画风,但人和动作别变
这种任务最重要的是“保身份”和“保姿势”。可以写明:保留人物面部轮廓、发型、站姿、手势和画面裁切,只把照片转为漫画线稿或二次元插画风。别只写“漫画风”,否则模型很可能把姿势也重新设计一遍。
如果人物识别度很重要,可以补一句“保留五官比例和头身关系,不夸张改变体型”。有些人想要漫画感,又希望一眼认得出本人,这时细节约束比风格词更关键。
做三格漫画,先把分镜定死
三格漫画最怕的是三张图各画各的。正确做法是先明确每一格的功能:第一格铺垫、第二格动作、第三格反应。提示词里要把镜头顺序写出来,而不是只写故事内容。
比如可以明确每格的位置、人物站位和情绪变化。只要分镜位置固定,模型更容易按同一画面逻辑展开。三格漫画不是单张图拼故事,而是先控制节奏,再控制画面。
把生活照变海报,留白一定提前讲
海报化处理时,人物可以更有气氛,但留白必须先定。比如要做左图右文,人物就尽量放左边或中间,右侧留出干净区域。要做竖版封面,人物就不要顶满上下边界,不然标题和副标题会很难放。
如果背景复杂,先让 AI 简化背景,再做第二轮海报化处理,往往比一次完成更稳。很多构图问题,本质上都出在“信息太满”。
一套可以直接套用的实战模板
下面这个模板适合大多数“保原图构图”需求,你可以按场景替换括号里的内容。
“保留原图构图,主体位于(左侧/中间/右侧)三分之一处,采用(平视/俯拍/仰拍)视角,画幅比例保持为(1:1/3:4/4:5/16:9),背景简化为(室内/街景/纯色/自然环境),保留(留白方向),不改变主体朝向、动作和层次关系,仅优化(服装/光影/线条/材质/色彩),避免重新安排场景元素。”
如果是人物照,还可以加一句“保持面部识别度和身体比例”。如果是商品图,加“保持商品边缘清晰、正面展示和台面位置”。如果是海报,加“保留标题区留白”。
这种写法的好处是,几乎所有约束都明说了。模型不需要猜,你也更容易判断到底是哪一项出了问题。
生成后别急着认命,细节修正要分层做
一张图构图没保住,不代表重做一定更好。先看问题出在哪一层:是主体位置偏了,还是比例错了,还是背景太挤。不同问题用不同修法,效率差很多。
如果只是主体稍微偏移,优先用裁切或局部重绘修正;如果视角错了,通常要降低重绘强度重做;如果留白不够,先尝试扩图或重新生成画幅;如果背景太乱,先做背景简化,再叠加主体细节。
修图时最好一次只改一件事。今天调构图,明天调色,后天再修脸。一次改太多,往往根本不知道是哪一步把构图带偏了。
有经验后,你会发现保构图不是一次性“写对神咒”,而是把参考图、提示词、参数和后期修改串成一条稳定流程。机灵助手这类工具的价值,也正在于把这几步尽量连起来,让你少在“重来一张”上浪费时间。
让构图稳定的真正关键,是减少模型猜测
AI 生成图时,越是模糊的要求,模型越会自己补全;越是具体的约束,画面越接近你的原图。保持原图构图,本质上不是让模型“理解你的审美”,而是让它少做判断题,多做填空题。
你给出主体位置、视角、比例、留白和禁止项,模型就更像一个执行者;你只说“高级一点、好看一点”,它就会按自己的想法重排画面。想稳,就别把最关键的信息藏在脑子里,要写出来。
能真正把原图构图保住的,通常不是某一句神奇提示词,而是一整套细节:清晰的参考图、明确的结构描述、合适的参数、必要的局部重绘,以及对结果的逐层修正。把这套流程跑顺,AI 才会越来越像一个可控的创作工具,而不是随机开盲盒。










