Blog/實作指南
實作指南

ChatGPT 修圖:聊天框對你的照片做不到的事

聊天式修圖每一輪都在算一張全新的圖。光是這一點,就解釋了飄移的人臉、糊掉的招牌和挪了位置的道具——也直接告訴你該怎麼寫提示詞繞開它。

2026年8月13日 · 7 分鐘閱讀

先講結論

GPT 類影像模型並不像分層編輯器那樣編輯你的照片。它讀圖、讀指令,然後畫出一張「應該看起來像原圖加上你的改動」的新圖。沒有遮罩,沒有鎖定,你不用文字說出來的東西一律不保證保留。光是這一個機制,就解釋了幾乎所有關於在聊天框裡修圖的抱怨——臉挪位了、招牌變成亂碼、桌上的道具跑到別處。這是可以配合的:把不能變的東西點名說出來,一次只改一處,並使用一個把比例、解析度、參考圖做成控制項而不是要靠句子去交涉的介面。在 Shotari 的 GPT Image 2 編輯器裡,一次修圖 5 點數;內建的 Shotari Basic 跑同樣一趟是 0。

Shotari 不是 ChatGPT

ChatGPT 是 OpenAI 的產品,本頁不是它。下面談的是用 GPT 類影像模型——也就是你在 Shotari 模型選擇器裡能選到的那一類——去修一張既有照片,以及一段聊天紀錄和一個專門打造的編輯器分別能給你什麼。這裡引用的每一個數字都是 Shotari 自己的,直接讀自執行扣款的那段程式碼。

為什麼你沒動的地方也變了

在 Photoshop 裡,編輯只在你讓它具破壞性的地方才具破壞性。一個選取範圍、一個遮罩、一個圖層——它們之外的部分逐位元組還是原檔案。生成式修圖完全沒有這套機制。你的照片作為參考進去,你的句子作為指令進去,回來的是一張全新算出來的圖。模型並不是在挪動你的像素,而是在畫一張它認為符合你對原圖描述的新圖。

所以問題從來不是「它為什麼改了那裡」,而是「它憑什麼要保留那裡」。凡是你沒點名的,都是模型可以重新決定的細節。落到實際上是這樣的。

你的要求實際回來的東西
把這張裁成 16:9一個新的 16:9 畫面,邊緣是被重新想像出來的,而不是被保留下來的。如果你要的是原像素紋絲不動、只畫新增區域,那是另一種操作——擴圖,不是修圖。
把左邊那個人去掉人不見了,填補也很自然。但畫面其餘部分也輕微飄移了:顆粒、色偏和背景裡的小物件全被重畫了一遍。
把襯衫改成紅色一件紅襯衫——外加有時候一張看起來老了一歲的臉,和一條換了邊的髮線。
保留招牌上的字小字會被逐字重畫。長字串經常以「看起來很像那麼回事的亂碼」形式回來。

釘住不該變的那幾句話

解法不是寫出一句更好的一行提示詞,而是給提示詞加上後半句,講清楚哪裡不准動。下面這四句承擔了絕大部分工作——正因為如此,Shotari 自家的範本裡裝的就是這幾句。

鎖定身分

Preserve the person's exact face, hairstyle, skin tone and body shape. Change only the background.

只改一處

Change only the sky. Leave the subject, the foreground objects and the framing exactly as they are.

鎖定產品

Keep the product, its label text and its proportions identical. Rebuild only the surface it sits on and the lighting.

鎖定文字

Do not redraw any text in this image. Reproduce every word exactly as it appears.

關於上限要講實話:鎖定文字能減少糊字,但消不掉。如果電話號碼或品牌名必須一字不差,就先生成不帶文字的圖,再到任何能畫真字體的編輯器裡補上。關於怎麼寫模型真的會聽的指令,見如何寫 AI 影像提示詞。

三步修圖法

1. 給它照片本身,而不是照片的描述

把原圖當成參考圖上傳,別去描述圖裡有什麼。Shotari 的輸入區一次最多接三張參考圖——正是這一點讓「把這個產品放到那個背景上,用這種風格」變成一次執行,而不是三輪交涉。

2. 一輪只改一處

每一輪都是全新運算,所以把兩條指令塞進同一個提示詞,疊加的是飄移而不是效果。改一處,看一眼,再從這個結果繼續跑。在 Shotari Basic 上每一輪都是 0 點數,沒有任何理由把它們綁在一起。

3. 最後一哩交給非生成式的工具

有些工作生成式修圖就是錯的工具。乾淨地去背是去背景;在不碰原像素的前提下加寬畫面是擴圖;修復受損的掃描檔是老照片修復。這三者保留下來的原圖內容,都比重畫多。

一次修圖要多少錢

一次執行、一張圖、一次扣款。沒有按則計費,也沒有需要精打細算的月度額度——按下按鈕之前,這一次的價格就擺在那裡。

模型每張圖點數適合做什麼
Shotari Basic0定稿之前的所有嘗試
Shotari Pro2品質更高;需要帳號
Seedream 5 Lite3最便宜的付費模型
GPT Image 25提示詞驅動的修改、圖上文字
GPT Image 1.55更快的修改、乾淨的文字
Nano Banana Pro10高保真精修

解析度和畫面比例會在這個基數上相乘:2K 是 ×1.5,4K 是 ×2.0,9:16 或 16:9 再疊 ×1.1,無條件進位。所以 GPT Image 2 的 4K + 16:9 是 5 × 2.0 × 1.1 = 11 點數,不是 5。

最讓人意外的一點:免費點數和付費點數不通用。註冊送的 20 點和每日簽到的 10 點只認 Shotari 自家模型,所以餘額 30 點照樣跑不了 5 點的 GPT Image 2。這是刻意設的規則,不是 bug——完整說明在GPT Image 2 免費嗎?。

它在哪裡拒絕、飄移或變慢

  • ⚠

    多數「失敗」是拒絕,不是當機

    我們把自己的生成失敗按路徑拆開看:文生圖成功率約 94%,幾乎所有失敗都落在圖生圖這條路徑上——而其中大多數是內容拒絕而非技術故障:被審核層判定為露骨的人像、可辨認的版權角色,以及一切長得像證件的東西。判別方法是:同一條提示詞換一張照片會立刻失敗。逐個錯誤的拆解見GPT Image 2 無法使用。

  • ⚠

    修一張圖比生成一張圖慢

    在我們的管線上,一次正常的圖生圖往返約 78 秒,是文生圖的好幾倍。一個跑了 30 秒的工作並沒有卡住——這一條我們是付了代價學到的:曾經把逾時設得比它所監控的工作還短。

  • ⚠

    免費下載帶浮水印

    訪客能生成但不能下載,下載按鈕會先要帳號。登入後的免費帳號下載的是帶 shotari.com 浮水印的版本,無浮水印檔案需要付費點數。這一點不隨你選哪個模型而改變。

  • ⚠

    不註冊的話每天兩次

    Shotari Basic 上按網路每天兩次生成,以 UTC 日界計算。Shotari Pro 要求在第一次執行之前登入,而不是之後。

常見問題

ChatGPT 能編輯既有的照片嗎?

能——聊天式影像模型可以接收你上傳的照片並回傳修改版。它做不到的是「就地編輯」。回傳的是整張圖的全新運算結果,所以你從沒提過的細節也會變了樣回來。

有免費的 ChatGPT 修圖工具嗎?

免費修圖有,免費的 GPT Image 2 沒有。Shotari Basic 是 0 點數,前兩次甚至不需要帳號,但 GPT Image 2 本身是每張 5 個付費點數。任何號稱白送高階模型的,不是在限時,就是在打浮水印。

為什麼我一修圖,人臉就變了?

因為模型把人和其他所有東西一起重畫了。加一句明確的話——「保持人物的臉和身分完全不變」——它就守得住;不加,那張臉就只是又一個模型可以重新決定的細節。

不註冊怎麼線上修圖?

打開編輯器,上傳照片,用 Shotari Basic 跑。不登入每天有兩次。真正必須要帳號的環節是下載結果。

可以上傳多張照片嗎?

每次執行最多三張參考圖。正是這一點讓你能把主體、背景和風格參考合進一條指令裡,而不用疊三次修改。

圖裡帶文字的修改該用哪個模型?

GPT Image 2 或 GPT Image 1.5,都是 5 點數——圖上文字正是它們最擅長的。先用 Shotari Basic 免費把構圖定下來,再把這 5 點數一次性花在你打算留下的那一版上。

要修的是照片,不是聊天紀錄

上傳你的圖,點名哪些東西不能變,然後跑。Shotari Basic 免費隨便試,定稿要換 GPT Image 2 時才花 5 點數。

開啟 GPT Image 2 編輯器