
AI 图片扩图看起来简单,真正难的是“扩得像原图”。很多人把画布一拉大,结果四周要么像硬生生补出来的,要么多出不属于原图的物体,人物脸部、衣服纹理、建筑线条也会跟着跑偏。想让扩图自然,关键不在于把尺寸放大,而在于先判断画面里哪些信息必须延续,哪些地方可以让模型自己补全。
扩图这件事,本质上是让模型根据现有画面推测“原本没拍到的部分”。如果原图信息足够清楚,扩图会更稳;如果原图已经很满、边缘又复杂,AI 就容易瞎猜。也就是说,扩图不是单纯的放大,而是一次“内容延展”。想要结果自然,就要把它当成一个精细的补画过程来看。
先判断这张图适不适合扩
不是所有图片都适合直接扩。最容易成功的,是主体集中、边缘留白明显、光线统一的图,比如单人肖像、产品图、天空、草地、室内静物、海报类图片。这类图的规律清楚,AI 比较容易沿着已有结构往外补。
不太适合直接扩的,是边缘本来就很乱的图,例如多人合照、密集城市街景、复杂织物、强透视建筑、手部特写。原因很简单:边缘信息越多,模型越难判断哪些线条、纹理、物体应该继续延伸,哪些只是局部遮挡。此时盲目扩图,最容易长出奇怪的手、重复的窗户、变形的栏杆。
判断标准可以很朴素:先看画面边缘有没有“可延续的规律”。如果能看出天空接着天空、桌面接着桌面、墙面接着墙面,这张图通常就好扩。若边缘已经充满主体、文字、反光、复杂图案,就要先做裁剪、局部修整,再扩图,效果会稳很多。
扩图前,先把原图整理干净
扩图前最重要的动作,往往不是点按钮,而是检查原图。原图里如果有压缩噪点、边缘锯齿、局部模糊,AI 在延展时会把这些问题一起放大。清晰、干净、层次明确的底图,扩图成功率会高很多。
有几个小习惯很有用:第一,尽量用高分辨率原图,不要拿已经很糊的图再扩;第二,先裁掉本来就没必要保留的边角杂物;第三,如果画面里有明显错误,比如歪掉的手指、扭曲的桌脚,先修掉再扩。因为模型会把这些错误当成“参考样式”,越扩越怪。
如果你用的是机灵助手这类带图片编辑能力的工具,建议先在编辑页把画布比例定好,再做扩图。这样可以避免扩完之后还要二次裁切,导致原本已经对齐的边缘又被重新破坏。很多人扩图不自然,不是模型不行,而是前面的图没收拾好。
让 AI 知道“往哪儿补”比“补什么”更重要
扩图时,提示词不需要写得像长篇说明书,重点是把画面延展方向交代清楚。比如人物在画面左侧,就可以明确“右侧继续延展室内空间”;如果主体在中间,可以说“上下扩展留出更多环境”;如果是海报构图,就说明“保留主体不变,四周补充与原图一致的背景”。
自然的扩图,通常遵循三个原则:延续原风格、延续原光线、延续原透视。只要这三件事对了,补出来的内容即使不是一模一样,也会看起来像原画的一部分。反过来,如果你只说“扩成更大尺寸”,模型就会自由发挥,最容易出现风格漂移。
一个实用写法是把提示词拆成四块:主体不变、画面延展、风格保持、细节一致。比如:
- 主体保持不变,人物表情和服装不改
- 左侧和上方补充同风格室内背景
- 光线保持柔和自然,色温一致
- 边缘细节与原图衔接平滑,不出现新增文字和多余物体
如果你常做图,可以把这种写法保存成模板。机灵助手里做图片扩展时,也适合把“不要改主体、只补边缘”这类约束写清楚,模型更容易沿着原图继续,而不是重新画一张“差不多的图”。
人像扩图,最怕脸和肩膀跑形
人像是最常见,也最容易翻车的场景。原因在于,人像主体本身信息集中,尤其脸、发型、肩膀、手臂这些部位,一旦接近边缘,AI 很容易误判并重新生成。想要扩得自然,最好让脸部完整落在原图范围内,扩图主要放在两侧、上下背景,不要让关键五官卡在边界上。
如果人像是半身照,扩图时可以优先补环境,不急着补人物;如果是全身照,则要特别注意脚下空间、地面纹理和身体比例。常见问题有三种:肩膀被拉宽、手臂多一截、发丝边缘变成乱线。处理方法是尽量让原图主体保持在中央,扩图比例不要太激进,先小幅扩一次,再看是否需要继续。
还有一个细节很重要:人像的光源方向要一致。比如原图右上方有窗光,扩图后左侧却突然变成逆光,整张图会立刻显假。扩之前最好观察阴影方向、脸部高光、背景亮度,这些东西一旦错位,扩出来的边缘再平滑也没用。
如果是证件照、形象照、写真类图片,扩图要尤其克制。保留人物完整轮廓即可,不要为了“更大”而给人物增加不必要的动作和姿态。人像扩图的核心不是让画面更热闹,而是让视野更宽,但人物本身不变。
产品图和电商图,背景比主体更该稳
电商产品图扩图的目标很明确:让商品看起来更完整,留出更多展示空间,或者为版式预留文案区域。这个场景里,主体商品一定要尽量固定,扩图主要发生在背景、台面、光影和装饰元素上。主体如果一变,图就很难用了。
以护肤品、食品、家电这类商品为例,扩图时通常会要求“产品居中,背景延展干净简洁,保留原有材质与灯光”。这样做的好处是,AI 会把注意力放在延展背景,而不是重画包装。对于电商场景,边缘最怕多出莫名其妙的瓶子、花朵、优惠券和字样,尤其是包装上的文字,一旦被改错,整张图都要重做。
如果你做的是促销图、详情页头图或平台主图,扩图时最好先确定最终用途。主图需要留白更干净,详情页首屏可以适度增加场景氛围,活动海报则要给标题和卖点留出空位。机灵助手这类工具在做电商图时,适合先明确“主图用途”还是“活动宣传用途”,否则模型会把装饰元素铺得太满。
有个很实用的做法:先扩背景,再补文字区。不要一开始就让 AI 把商品、文案、装饰同时扩出来。先把画面四周整理成足够自然的空场,再决定哪里放标题、角标、促销元素,这样排版会更稳,商品也不会被冲散。
风景图扩图,关键是地平线和纹理别断
风景图扩图常见于壁纸、海报、旅行照和封面图。这里最敏感的不是人物,而是地平线、山脊、云层、水面、道路这些有明确走向的结构。只要这些线断了,整张风景就会显得不真实。
扩风景时,最容易出问题的地方有两个:一是水面和天空的过渡不均匀,二是远景重复得太明显。比如海面扩图后出现一条条相似浪纹,或者山体边缘长出不合理的重复山峰,这种情况往往是因为模型没有理解画面的空间层次。处理办法是明确告诉 AI:远景保持自然延续,纹理不要重复,地平线连续且平滑。
如果是城市风景,还要留意建筑边界、窗户排列、道路透视。建筑图像对几何一致性要求很高,稍微偏一点就会被看出来。扩图时可以优先扩天空、前景草地、道路两侧,这些区域容错更高;尽量少扩建筑正面密集区域,尤其是规则窗格和广告牌。
在风景扩图里,色彩统一也很关键。晨光、黄昏、阴天、夜景的色温差异很大,扩图后如果天空亮度变了、阴影方向变了,图就会有拼接感。宁可扩少一点,也不要让天空、地面和远景各自进入不同的光线逻辑。

插画、海报和封面图,留白要和风格一起扩
插画类扩图和照片不太一样。照片讲究真实,插画更看重风格统一。扩图时,如果线条粗细、笔触方向、色块边缘没有跟原图一致,就会显得像拼贴。特别是二次元、扁平插画、手绘海报这类图,扩出来的部分不仅要“像”,还要“画法一致”。
这类图最值得关注的是留白。海报、封面、社媒配图往往不是把画面填满,而是要给标题、标语、logo 留地方。扩图时可以明确要求“保留顶部或右侧留白,画面元素向另一侧延展”,这样成品更容易直接用于排版。留白不是空洞,而是为后续设计预留秩序。
如果原图是故事感强的插画,扩图时还要注意视线和动作的延续。人物看向哪里,光线从哪里来,景物如何围绕主体展开,这些都不能随便改。可以把提示词写成“延续同一插画风格、同一线条节奏、同一配色体系”,这样模型更容易保持画面统一。
用机灵助手这类工具做插画扩图时,适合先确认成品用途:是社媒头图、文章封面、活动海报,还是单纯的完整画幅。用途不同,留白比例就不同。很多扩图失败,不是画得不好,而是把本该留空的区域也补满了,结果后期根本没法排版。
提示词别写太多,三件事说清就够了
扩图提示词不需要堆很多形容词,真正有效的部分通常只有三类:保留什么、补什么、别改什么。只要这三件事交代清楚,模型就能更稳定地沿着原图延展。
可以参考这个顺序来写:
- 保留主体:人物、商品、建筑主结构不变
- 补充区域:左侧背景、上方天空、下方台面等
- 保持一致:光线、色调、材质、透视、风格统一
- 避免错误:不要新增文字、不要重复物体、不要扭曲边缘
如果你已经习惯用关键词生成图,也可以把扩图提示词写得像约束清单。比如“延展同款木质桌面、延续柔和侧光、保持原始景深、边缘自然过渡、不要增加新物体”。这种写法比单纯说“更自然一点”有效得多,因为模型更容易抓住具体要求。
有些人会把提示词写成“高级感、氛围感、精致、唯美”,这些词不是完全没用,但对扩图帮助有限。扩图最需要的是结构信息,而不是形容词。换句话说,告诉模型“哪里能长,哪里不能动”,比告诉它“要好看”重要得多。
看起来假,通常是这几个细节出了问题
扩图后如果一眼就觉得假,通常不是整体风格不对,而是某个局部细节没接上。最常见的是边缘纹理断裂、阴影方向错、重复元素太多、主体比例变化、颜色过渡突兀。只要其中一个出错,用户很快就能看出拼接感。
检查时可以按这个顺序看:先看结构,再看光线,再看纹理,最后看颜色。结构问题最严重,比如门框歪了、桌面倾斜了、人物肩膀拉长了;光线问题其次,比如左边亮右边暗但逻辑不通;纹理和颜色通常是最后才暴露出来的细节,但也会影响真实感。
一个实用习惯是把扩图结果缩小到手机屏幕大小再看。很多在大图里不明显的小问题,缩小后会立刻暴露出来。尤其是重复的窗户、过分平滑的皮肤、杂乱的树枝、莫名其妙的边缘装饰,缩小看会更容易发现。
如果是重要成品,别怕多做两轮。第一次扩图通常是把画幅和主体关系调顺,第二次再修边缘细节和色彩。比起一口气生成“看上去很满”的图,分两步做出来的图往往更自然,也更接近可用成品。
不同场景里,最稳的做法其实不一样
人像扩图,先保脸和肩膀;产品扩图,先保包装和材质;风景扩图,先保地平线和透视;插画扩图,先保线条和色块。看起来方法很多,其实核心一致:把最不能错的部分固定住,让 AI 只负责补环境。
如果你经常要处理不同类型的图片,可以把扩图当成一个“场景判断题”。先看画面主角是谁,再看边缘能不能自然延展,接着决定是该补背景、补留白,还是补空间。这个判断做好了,后面的操作会轻松很多。
在实际工作里,很多人会用机灵助手先试一版,快速看整体延展是否符合预期,再针对具体问题微调提示词。这样比反复手工修图更省时间,也更适合电商、内容配图、社媒封面这些需要快速出图的场景。扩图的终点不是“AI 画得多”,而是“别人看不出这是补出来的”。










