ChatGPT 中文专题

模型专题

ChatGPT怎么修改图片?只改局部应该怎么说

GPT-6 Astra 中文专题 · 内容整理于

ChatGPT怎么修改图片?只改局部应该怎么说缩略图

很多人第一次用ChatGPT修改图片,会遇到一个非常典型的问题:

明明只说“把衣服换成黑色”,结果人物的脸也变了。

明明只想删掉桌上的杯子,结果桌子、灯光甚至整个背景都重新生成了一遍。

这通常不是“ChatGPT不能局部修改”,而是你的指令还不够明确。

2026年的ChatGPT Images已经支持直接编辑现有图片。你可以上传自己的图片,也可以打开之前由ChatGPT生成的图片,然后通过两种方式修改:

  • 直接用文字描述要改哪里
  • 使用选择工具圈出要修改的区域,再告诉ChatGPT怎么改

真正想让结果稳定,最好记住一句非常实用的话:

“只修改X,其他内容保持不变。”

这句话看起来简单,但在局部改图里非常重要。

第一次修改图片,直接上传原图就可以

如果你有一张已经存在的照片,不需要重新描述整张图。

直接把图片上传到ChatGPT,然后说:

修改这张图片。

只把背景改成浅灰色摄影棚,
人物、衣服、脸、姿势和构图全部保持不变。

不要重新生成主体。

这种写法比:

把这张图改高级一点。

准确得多。

因为后一句里的“高级”没有说明:

  • 哪里要改
  • 哪些东西不能改
  • 最终想要什么结果

只改局部,最好同时说清楚3件事

局部修改可以用一个非常简单的结构:

修改位置 + 修改内容 + 保持不变的内容。

比如:

只修改人物上衣。

把蓝色T恤换成黑色圆领T恤。

人物脸部、发型、身体姿势、背景、
光线和画面构图全部保持不变。

这里最关键的不是“黑色T恤”。

而是你明确告诉ChatGPT:

剩下的东西不要重新设计。

“只改这个地方”比“重新生成一张”更重要

如果原图已经有80%是满意的,就不应该再从头描述整个画面。

例如原图中:

  • 人物已经很好
  • 角度已经正确
  • 灯光已经满意

只是背景不对。

那么应该写:

保留当前图片。

只修改背景。

把原来的办公室背景换成纯白色摄影棚,
增加非常自然的地面接触阴影。

人物本身、姿势、服装、脸部和相机角度不要变化。

而不是重新写:

生成一个人在白色摄影棚里的照片。

后者相当于让模型重新创作,自然更容易把人物一起改掉。

局部修改最实用的万能模板

如果不知道怎么写,可以直接套:

修改这张图片。

只修改:【具体区域】

修改为:【想要的效果】

必须保持不变:
【人物/产品/背景/构图/光线/文字等】

不要重新生成其他区域。

例如:

修改这张图片。

只修改桌面左侧的咖啡杯。

把黑色杯子换成白色陶瓷杯。

桌子、电脑、人物、背景、光线和画面比例保持不变。

不要修改其他区域。

想改人物衣服,应该怎么说?

人物图片最容易发生“改衣服顺便换脸”。

所以要特别强调身份特征。

可以写:

只修改人物的衣服。

把当前白色衬衫换成深灰色西装外套,
内搭仍然保持白色。

不要修改:
脸部、
五官、
发型、
肤色、
年龄、
身体比例、
姿势、
背景和光线。

如果人物长相非常重要,还可以加一句:

人物必须保持为同一个人,不要重新设计面部特征。

这种表达比:

“给他换个西装。”

稳定得多。

只换背景怎么说?

背景替换也是最常见的局部编辑。

例如商品图:

只修改背景。

保留产品本身的造型、比例、颜色、Logo和标签。

把背景换成浅灰色商业摄影棚,
增加自然阴影和轻微地面反射。

不要改变产品外观。

如果是人物:

只替换背景。

把当前室内背景改成城市夜景,
背景轻微虚化。

人物、脸、头发、衣服、姿势和原有光线方向保持不变。

为什么“保留产品不变”一定要单独写?

如果是电商、品牌或者产品展示图,这一点尤其重要。

模型在重新生成背景时,也可能顺带调整:

  • 产品边缘
  • Logo
  • 标签文字
  • 按钮
  • 接口
  • 材质细节

所以商品修改建议直接写:

产品是固定主体。

禁止重新设计产品。

保持产品外形、Logo、标签、颜色、
按钮位置和细节完全一致。

只修改背景和地面环境。

对于需要精确展示真实商品的场景,修改完成后仍然应该检查关键细节。

只删除一个物体怎么说?

例如想删掉桌面上的杯子:

只删除桌面右下角的红色杯子。

删除后自然补全被遮挡的桌面纹理。

其他物体的位置、大小、颜色和光线保持不变。

注意这里不只是说“删除杯子”。

还告诉它:

删除以后应该怎么处理空出来的位置。

这对于自然修图很有帮助。

想增加一个物体,也不要只说“加上去”

比如:

只在桌面左侧增加一本合上的黑色笔记本。

笔记本尺寸不要太大,
角度与桌面透视一致,
光线方向与原图一致。

不要移动桌上的其他物品。

如果新增内容涉及空间关系,最好告诉ChatGPT:

  • 放在哪里
  • 大小
  • 朝向
  • 与其他物体的关系

例如:

“在电脑左边”

通常比:

“桌子上加一本书”

更容易得到正确结果。

选择工具适合什么情况?

如果文字描述很难说清修改位置,可以直接使用ChatGPT Images中的选择工具。

例如画面里有三个杯子,你只想改中间那个。

仅仅写:

“把杯子变成白色。”

就可能出现歧义。

这时候可以:

  1. 打开图片
  2. 进入编辑器
  3. 选择Select
  4. 圈出中间的杯子
  5. 再输入修改要求

例如:

把选中的杯子改成白色陶瓷材质。

形状保持不变,
其他区域不要修改。

这样ChatGPT更清楚你指的是哪一个对象。

用了选区,就一定只会改选区吗?

不一定。

OpenAI目前明确提醒:

图片编辑中的选区并不是绝对像素级精确,修改有时可能延伸到选择区域之外。

所以即使已经使用选择工具,提示词里仍然建议写:

只修改选中区域。

选区外的内容尽量保持原样。

如果边缘细节非常重要,修改后一定要检查周围区域。

怎么让人物的脸尽量不要变化?

人物一致性是局部改图里最常见的问题之一。

如果只是改衣服、背景或者手里的物品,可以重复强调:

保持人物身份完全一致。

不要改变:
脸型、
眼睛、
鼻子、
嘴巴、
发型、
年龄、
肤色。

只修改【指定内容】。

还可以继续补:

不要重新生成整个人物,
只编辑指定区域。

如果第一次修改后脸部发生变化,不要马上重新从头生成。

可以继续说:

刚才的修改影响了人物脸部。

恢复原图中的脸部特征,
保留新的衣服,
其他内容不要变化。

修改背景时,光线为什么也容易变?

因为背景、光线、阴影在视觉上是互相关联的。

如果把白天室内换成夜晚街道,模型可能自然重新调整人物光线。

如果你不希望主体光线变化,就要明确说:

只更换背景环境。

人物原有光线、肤色和曝光保持不变。

新的背景需要适配人物当前光线,
不要重新给人物打光。

反过来,如果你希望整体更自然,也可以允许同步调整:

背景改成傍晚户外。

允许轻微调整人物边缘光,
让人物与新背景融合自然,
但不要改变脸部和服装。

只修改文字怎么说?

例如一张海报已经做好,只是标题写错了。

不要说:

“重新生成正确标题的海报。”

而是:

保持整张海报设计完全不变。

只修改顶部标题文字。

原文字:
“ChatGPT图片教程”

改成:
“ChatGPT 图片生成教程”

字体、字号、颜色、位置和排版保持不变。

不要添加其他文字。

这种写法的核心还是:

明确修改对象 + 明确保留条件。

修改中文时,最好把正确文字完整写出来

不要只说:

“把错别字改一下。”

最好明确:

只修改标题。

正确文字必须是:
“ChatGPT 怎么修改图片?”

请逐字保持一致。

其他文字和画面都不要变化。

尤其是:

  • 中文标题
  • 价格
  • 日期
  • 产品名称
  • 品牌名

最好都把最终正确内容完整写出来。

只改颜色怎么说?

例如商品颜色:

只修改耳机外壳颜色。

把银色改成哑光黑色。

材质、结构、Logo、按钮、角度、
阴影和背景全部保持不变。

人物衣服颜色:

只把外套颜色从红色改成深蓝色。

不要改变衣服款式、材质、褶皱,
人物和背景全部保持不变。

这里最好同时告诉模型:

只换颜色,不换材质和形状。

只改构图,可以说“移动”,不要说“重新排版”

例如网站Banner需要左侧留白:

保持人物、背景和整体风格不变。

把人物整体向右移动,
让左侧留下约40%的干净空间。

不要增加新元素,
不要修改人物外观。

如果需要换比例:

把图片改成16:9横版。

保留当前主体和视觉风格,
主体保持在右侧,
新增画面区域主要扩展左侧背景。

不要裁掉人物。

ChatGPT Images目前也支持直接调整宽高比。

怎么把背景改成透明?

可以直接说:

只保留主体。

移除所有背景,
改成透明背景。

主体边缘要干净,
不要增加白底、阴影或其他元素。

如果需要保留阴影,可以改成:

移除背景并改成透明背景。

保留主体下方原有的自然接触阴影,
不要修改产品本身。

同一张图片修改很多次,为什么越来越不像原图?

这种现象可以理解为“编辑漂移”。

每一次修改都可能重新生成部分视觉内容。

如果连续十几次:

  • 换背景
  • 换衣服
  • 改颜色
  • 加物体
  • 改光线

图片可能逐渐偏离最初版本。

更好的方法是:

一次只解决一个问题。

OpenAI当前的图片提示指南也建议使用小范围、明确的连续修改,而不是每一轮同时提出大量变化。

例如:

第一轮只改背景。

第二轮只改衣服。

第三轮只修文字。

不要一条指令同时改十个地方。

如果修改失败,别说“还是不对”

“还是不对”对模型没有太多具体信息。

更有效的反馈是:

背景修改正确。

但是人物脸部发生了变化。

请保留现在的新背景,
恢复原图人物脸部,
其他内容不动。

或者:

杯子颜色正确,
但杯子形状变了。

保留现在的白色,
恢复原图杯子的形状和大小。

每次只指出:

哪里已经对了 + 哪里还需要改。

通常比重新发一大段完整Prompt更有效。

产品图局部修改,可以直接用这套Prompt

修改这张产品图片。

产品本身必须保持完全一致:
外形、
比例、
颜色、
Logo、
标签、
按钮、
接口。

只修改背景。

把背景改成浅灰色商业摄影棚,
添加自然接触阴影,
整体简洁、高级。

禁止重新设计产品。

人物换衣服,可以复制这套

保持人物为同一个人。

只修改衣服。

把当前休闲T恤换成黑色西装,
款式简洁正式。

不要修改:
脸部、
发型、
肤色、
年龄、
身体比例、
姿势、
背景、
相机角度。

删除路人,可以这样说

只删除人物左后方的路人。

删除以后自然补全原来的街道和背景。

前景人物、建筑、车辆、光线和构图全部保持不变。

只改天空,可以这样说

只修改天空区域。

把阴天天空换成蓝天和少量自然白云。

建筑、树木、地面、人物和原有透视全部保持不变。

不要改变照片整体曝光。

室内装修换颜色,可以这样说

只修改墙面颜色。

把当前深灰色墙面改成暖白色。

家具、地板、窗户、灯具的位置和造型全部保持不变。

不要重新设计房间。

只改Logo或标签,要更加谨慎

如果是真实品牌产品,Logo和产品文字往往属于非常精细的视觉元素。

这类局部编辑可以尝试,但修改以后一定检查:

  • 字母有没有变化
  • Logo比例是否准确
  • 文字有没有拼错
  • 产品标签有没有被重绘

如果Logo必须100%保持准确,最稳妥的方式往往是后续再使用专业图像编辑软件进行最终校对。

多张参考图怎么说才不会乱?

如果同时上传多张图片,不要只说:

“按照这些参考图修改。”

最好明确每一张图片的作用。

图1是需要修改的原图。

图2只参考背景风格。

图3只参考灯光效果。

请保持图1中的人物、姿势和服装不变,
只把背景调整为接近图2的简洁风格,
灯光参考图3。

不要复制图2和图3中的人物或物体。

OpenAI当前也建议,多参考图时明确每张图片的职责,通常比一次上传大量图片但不解释关系更稳定。

只改局部时,最容易犯的几个错误

错误一:只说要改什么,不说什么不能改。

“换背景”不如“只换背景,人物保持不变”。

错误二:描述范围太模糊。

“把左边东西删掉”不如“删除左下角桌面上的红色杯子”。

错误三:一次要求修改太多。

局部编辑最好逐步进行。

错误四:每次不满意都从头生成。

如果大部分内容已经正确,继续围绕当前图片修改更容易保持一致。

错误五:认为选区绝对不会影响外部。

官方明确说明,局部选区并不是绝对像素级边界,修改有可能延伸到附近区域。

最后记住这个“局部修改四句话”

以后如果不知道怎么表达,直接按照下面四句话说:

只修改【具体区域】。

把它改成【具体效果】。

【列出必须保持不变的元素】全部保持不变。

不要重新生成其他区域。

例如:

只修改人物手里的手机。

把黑色手机换成银色手机。

人物脸部、手势、衣服、背景、光线和构图保持不变。

不要重新生成其他区域。

这其实就是ChatGPT局部修改图片最核心的提示词逻辑。

不是写得越长越好,而是:

明确改哪里、改成什么、什么绝对不能动。

如果文字仍然无法准确定位目标,就配合选择工具圈出区域。

对于重要人物、真实产品、品牌Logo等需要高度一致的内容,修改以后还应该仔细检查细节。

当你开始习惯使用:

“只修改”“保持不变”“不要重新生成”“恢复原图中的……”

这些表达以后,ChatGPT修图会比一句“帮我优化一下这张图”可控得多。

资料来源:OpenAI 官方模型文档。产品参数以官方更新为准;提示词与工作方法为本站编辑建议。