Blog/实操指南
实操指南

ChatGPT 修图:聊天框对你的照片做不到的事

聊天式修图每一轮都在渲染一张全新的图。仅这一点就解释了漂移的人脸、糊掉的招牌和挪了位置的道具——也直接告诉你该怎么写提示词绕开它。

2026年8月13日 · 7 分钟阅读

先说结论

GPT 类图像模型并不像分层编辑器那样编辑你的照片。它读图、读指令,然后画出一张「应该看起来像原图加上你的改动」的新图。没有蒙版,没有锁定,你不用文字说出来的东西一律不保证保留。仅这一个机制,就解释了几乎所有关于在聊天框里修图的抱怨——脸挪位了、招牌变成乱码、桌上的道具跑到了别处。这是可以配合的:把不能变的东西点名说出来,一次只改一处,并使用一个把比例、分辨率、参考图做成控件而不是要靠句子去交涉的界面。在 Shotari 的 GPT Image 2 编辑器里,一次修图 5 积分;内置的 Shotari Basic 跑同样一趟是 0。

Shotari 不是 ChatGPT

ChatGPT 是 OpenAI 的产品,本页不是它。下面讲的是用 GPT 类图像模型——也就是你在 Shotari 模型选择器里能选到的那类——去修一张已有照片,以及一段聊天记录和一个专门造出来的编辑器分别能给你什么。这里引用的每一个数字都是 Shotari 自己的,直接读自执行扣费的那段代码。

为什么你没动的地方也变了

在 Photoshop 里,编辑只在你让它具有破坏性的地方才具有破坏性。一个选区、一个蒙版、一个图层——它们之外的部分逐字节还是原文件。生成式修图完全没有这套机制。你的照片作为参考进去,你的句子作为指令进去,回来的是一张全新的渲染结果。模型并不是在挪动你的像素,而是在画一张它认为符合你对原图描述的新图。

所以问题从来不是「它为什么改了那儿」,而是「它凭什么要保留那儿」。凡是你没点名的,都是模型可以重新决定的细节。落到实处是这样的。

你的要求实际回来的东西
把这张裁成 16:9一个新的 16:9 画幅,边缘是被重新想象出来的,而不是被保留下来的。如果你要的是原像素纹丝不动、只画新增区域,那是另一种操作——扩图,不是修图。
把左边那个人去掉人没了,填补也很自然。但画面其余部分也轻微漂移了:颗粒、色偏和背景里的小物件全被重画了一遍。
把衬衫改成红色一件红衬衫——外加有时候一张看上去老了一岁的脸,和一条换了边的头路。
保留招牌上的字小号文字会被逐字重画。长字符串经常以「看着很像那么回事的乱码」形式返回。

钉住不该变的那几句话

解法不是写出一句更好的一行提示词,而是给提示词加上后半句,说清楚哪里不许动。下面这四句承担了绝大部分工作——正因为如此,Shotari 自家的模板里装的就是这几句。

锁定身份

Preserve the person's exact face, hairstyle, skin tone and body shape. Change only the background.

只改一处

Change only the sky. Leave the subject, the foreground objects and the framing exactly as they are.

锁定产品

Keep the product, its label text and its proportions identical. Rebuild only the surface it sits on and the lighting.

锁定文字

Do not redraw any text in this image. Reproduce every word exactly as it appears.

关于上限要说实话:锁定文字能减少糊字,但消不掉。如果电话号码或品牌名必须一字不差,就先生成不带文字的图,再到任何能画真字体的编辑器里补上。关于怎么写模型真正会听的指令,见如何写 AI 图像提示词。

三步修图法

1. 给它照片本身,而不是照片的描述

把原图作为参考图上传,别去描述图里有什么。Shotari 的输入区一次最多接三张参考图——正是这一点让「把这个产品放到那个背景上,用这种风格」变成一次运行,而不是三轮交涉。

2. 一轮只改一处

每一轮都是全新渲染,所以把两条指令塞进同一个提示词,叠加的是漂移而不是效果。改一处,看一眼,再从这个结果继续跑。在 Shotari Basic 上每一轮都是 0 积分,没有任何理由把它们捆在一起。

3. 最后一公里交给非生成式的工具

有些活儿生成式修图就是错的工具。干净地抠出主体是去背景;在不碰原像素的前提下加宽画幅是扩图;修复受损的扫描件是老照片修复。这三者保留下来的原图内容,都比重画多。

一次修图要多少钱

一次运行、一张图、一次扣费。没有按条计费,也没有需要精打细算的月度额度——按下按钮之前,这一次的价格就摆在那里。

模型每张图积分适合做什么
Shotari Basic0定稿之前的所有试验
Shotari Pro2质量更高;需要账号
Seedream 5 Lite3最便宜的付费模型
GPT Image 25提示词驱动的修改、图上文字
GPT Image 1.55更快的修改、干净的文字
Nano Banana Pro10高保真精修

分辨率和画幅会在这个基数上相乘:2K 是 ×1.5,4K 是 ×2.0,9:16 或 16:9 再叠 ×1.1,向上取整。所以 GPT Image 2 的 4K + 16:9 是 5 × 2.0 × 1.1 = 11 积分,不是 5。

最让人意外的一点:免费积分和付费积分不通用。注册送的 20 分和每日签到的 10 分只认 Shotari 自家模型,所以余额 30 分照样跑不了 5 分的 GPT Image 2。这是有意设的规则,不是 bug——完整说明在GPT Image 2 免费吗?。

它在哪里拒绝、漂移或变慢

  • ⚠

    多数「失败」是拒绝,不是崩溃

    我们把自己的生成失败按路径拆开看:文生图成功率约 94%,几乎所有失败都落在图生图这一条路径上——而其中大多数是内容拒绝而非技术故障:被审核层判定为露骨的人像、可辨认的版权角色,以及一切长得像证件的东西。判别方法是:同一条提示词换一张照片会立刻失败。逐个错误的拆解见GPT Image 2 用不了。

  • ⚠

    修一张图比生成一张图慢

    在我们的管线上,一次正常的图生图往返约 78 秒,是文生图的好几倍。一个跑了 30 秒的任务并没有卡住——这一条我们是花了代价学到的:曾经把超时设得比它所监控的任务还短。

  • ⚠

    免费下载带水印

    游客能生成但不能下载,下载按钮会先要账号。登录后的免费账号下载的是带 shotari.com 水印的版本,无水印文件需要付费积分。这一点不随你选哪个模型而改变。

  • ⚠

    不注册的话每天两次

    Shotari Basic 上按网络每天两次生成,以 UTC 日界计算。Shotari Pro 要求在第一次运行之前登录,而不是之后。

常见问题

ChatGPT 能编辑已有的照片吗?

能——聊天式图像模型可以接收你上传的照片并返回修改版。它做不到的是「就地编辑」。返回的是整张图的全新渲染,所以你从没提过的细节也会变了样回来。

有免费的 ChatGPT 修图工具吗?

免费修图有,免费的 GPT Image 2 没有。Shotari Basic 是 0 积分,前两次甚至不需要账号,但 GPT Image 2 本身是每张 5 个付费积分。任何号称白送高级模型的,要么在限时,要么在打水印。

为什么我一修图,人脸就变了?

因为模型把人和其他所有东西一起重画了。加一句明确的话——「保持人物的脸和身份完全不变」——它就能守住;不加,那张脸就只是又一个模型可以重新决定的细节。

不注册怎么在线修图?

打开编辑器,上传照片,用 Shotari Basic 跑。不登录每天有两次。真正必须要账号的环节是下载结果。

可以上传多张照片吗?

每次运行最多三张参考图。正是这一点让你能把主体、背景和风格参考合进一条指令里,而不用叠三次修改。

图里带文字的修改该用哪个模型?

GPT Image 2 或 GPT Image 1.5,都是 5 积分——图上文字正是它们最擅长的。先用 Shotari Basic 免费把构图定下来,再把这 5 积分一次性花在你打算留下的那一版上。

要修的是照片,不是聊天记录

上传你的图,点名哪些东西不能变,然后跑。Shotari Basic 免费随便试,定稿要换 GPT Image 2 时才花 5 积分。

打开 GPT Image 2 编辑器