Skip to content

GPT Image 2 完整上手指南

最後更新:2026-09-09· 15 分鐘閱讀

🚀 快速通道

  • GPT Image 2 國內版:點擊直達↗
  • 文生圖工作台:開啟鏡像↗
  • 官方 ChatGPT:chatgpt.com ↗

GPT Image 2 完整上手指南

更新時間:2026-08-21。模型 ID、解析度檔位、quality 選項與計費以 ChatGPT 與 OpenAI Platform 圖像文件 當日說明為準。

導讀

GPT Image 2 是 OpenAI 圖像線仍在廣泛使用的旗艦檔之一:API 常見識別為 gpt-image-2(以文件當日為準;介面也可能顯示為 ChatGPT Images 相關名稱)。相對上一代 GPT Image 1.5(gpt-image-1.5),它在指令跟隨、編輯精度與畫面內文字上通常更強。若你要跟進 2026-09 發布的 Images 2.5(產品名 ChatGPT Images 2.5;API 為 Flare/Sunburst),請讀 GPT Image 2.5:Flare / Sunburst 選型與上手。本篇只講如何在 Image 2 上穩定交圖。

這篇解決什麼問題?

  • 釐清 GPT Image 2 的旗艦定位,以及何時仍可留在 1.5
  • 建立「先構圖 → 再局部改 → 再調尺寸/quality」的可重現工作流
  • 提高畫面內文字成功率,並正確理解解析度與 quality
  • 用檢查清單在交付前攔住常見翻車點

GPT Image 2 的旗艦定位

把它當成預設定稿檔:文章頭圖、行銷主視覺、產品多輪精修、需要較強文字渲染或參考約束的稿件。品質與編輯可控性落在日常交付甜點區;相對 1.5,更適合「一次寫清約束、多輪只改一處」的嚴肅工作流。

產品名、ChatGPT 介面展示名與 API 模型 ID 可能並不逐字相同。寫入團隊規範時記下:入口 URL+介面顯示名+文件模型 ID+日期。家族對照見 GPT Image 是什麼?。

相對 GPT Image 1.5:怎麼選

維度GPT Image 1.5GPT Image 2(本文)
角色上一代可用檔/相容與對照當前旗艦主力
常見 ID 線索gpt-image-1.5gpt-image-2
指令與改圖已較強通常更穩、更適合複雜多輪
畫面文字可用,但仍需終檢通常更適合短標題級渲染
尺寸/quality以當日文件為準以當日文件為準;優先在 2 上吃滿可用檔
建議用法流水線鎖定、對照重現、成本敏感草稿日常定稿與對外交付

快速決策:

  1. 新專案、對外主視覺、要文字或強編輯 → 用 2。
  2. 已有流水線釘死 gpt-image-1.5、或需要與歷史稿件視覺對照 → 可暫留 1.5,並規劃遷移,見 GPT Image 1.5 選型與遷移。
  3. 不確定入口裡叫什麼名字 → 打開模型選擇器或 Platform 文件,核對當日 ID,不要憑記憶寫進合約。

生成+改圖工作流(可重現)

目標不是一次提示詞寫小說,而是每輪只驗證一件事。

第 0 步:寫清驗收單(發提示前)

在筆記裡先寫四行,再打開對話或 API:

  1. 用途:頭圖/海報主視覺/電商主圖/簡報插圖
  2. 畫布:比例或目標尺寸檔(如 16:9)、是否預留標題區
  3. 主體與數量:幾個物體、人物朝向、是否露臉
  4. 禁止項:無浮水印、無亂碼字、無額外肢體、無未授權品牌

第 1 輪:只出構圖

提示詞依「用途 → 主體 → 構圖/鏡頭 → 光線配色 → 材質風格 → 畫面文字(可先不要)→ 禁止項」寫短,不要一次塞滿風格形容詞。

用途:16:9 部落格頭圖,右側留白給標題。
主體:一台霧面陶瓷桌面音箱,置中略偏左。
鏡頭:平視,約 50mm,背景虛化淺景深。
光線:窗邊柔光,冷灰與暖木色。
風格:乾淨產品攝影,不要插畫感。
禁止:浮水印、邊框、多餘電線、變形的按鍵、畫面內任何文字。

驗收只看:主體是否正確、比例是否對、留白是否夠、有沒有畸形結構。構圖不對就整輪重抽,不要在錯誤構圖上堆局部修改。

第 2 輪:只改一個變數

明確「保持不變」再提改動:

保持同一鏡頭、主體姿勢、配色與背景。
只做一件事:把音箱表面從霧面陶瓷改成拉絲鋁合金。
不要改構圖,不要添加文字或 Logo。

GPT Image 2 的優勢是約束跟隨更穩。一次改光線、材質、文字、背景四處,模型會顧此失彼,你也無法判斷是哪條指令失效。

第 3 輪:加參考圖(需要一致性時)

上傳 1–數張你有權使用的參考圖,並寫清每張圖管什麼:

圖1:產品幾何與按鍵佈局(必須一致)。
圖2:品牌主色(僅配色參考,不要複製包裝文案)。
生成:同一產品置於深色桌面,16:9,仍不要畫面文字。

不要要求模仿在世藝術家畫風,也不要上傳無授權素材。商品圖必須對照原始檔核對 Logo 與結構。

第 4 輪:調尺寸/quality 與終檢

構圖與細節都過關後,再依介面或 API 當日支援的選項選擇目標尺寸與 quality。提高 quality 或解析度不能修復錯誤構圖或錯字——它只會讓問題更醒目。

完整從零流程另見 新手入門:第一次出圖。提示詞寫法深挖見 提示詞實戰指南。

畫面內文字怎麼提高成功率

GPT Image 2 在文字渲染上通常強於 1.5,但仍不是印刷級排版引擎。

  1. 文案要短:標題級短句;法律小字、QR Code、密集表格不要指望一次生成正確。
  2. 用引號給出準確文本,並聲明語言與大小寫:畫面右上角白色無襯線標題:"GPT Image 2"。
  3. 先無字出圖,再在設計軟體排字:拼寫零容錯、多語言混排、品牌 VI 強約束時,這是更穩的交付路徑。
  4. 改字單獨一輪:保持構圖與主體,只把標題改成:"……",不要順手改背景。
  5. 終檢時逐字對照源文案;中英文混排、數字、註冊商標符號最容易錯。

解析度與 quality 怎麼設

不寫死像素表或列舉值——OpenAI 會調整可選尺寸與 quality 檔,以 Platform 與當前 ChatGPT 介面為準。

實作原則:

  • 先定比例/用途,再選尺寸檔;比例寫在提示詞最前。
  • 草稿可用較低 quality 或較小尺寸探方向,定稿再拉高;價格與額度以當日計價為準。
  • 交付前同時看縮圖和原尺寸。寬高選項、quality 名稱以介面與文件當日清單為準。
  • API 自動化時把 model、size、quality、提示詞摘要寫進執行日誌,便於重現與對帳。

完成檢查清單

  • 入口與模型身分已記錄(介面名/文件 ID/日期),確認用的是 GPT Image 2(gpt-image-2)而非 1.5
  • 比例與用途一致,標題/裁切安全區足夠
  • 主體數量、手部/邊緣、反射與陰影無明顯崩壞
  • 多輪修改時每輪只改一個變數,且寫明「保持不變」項
  • 參考圖用途已說明,素材有使用權紀錄
  • 畫面文字已逐字核對,或已改為「無字圖+後期排版」
  • 無意外 Logo、浮水印、簽名、未授權品牌
  • 已在目標尺寸與選定 quality 下終檢;縮圖與原圖都看過
  • 價格、額度、模型 ID、尺寸/quality 列舉未寫進對外承諾的死值(以文件當日為準)

快速通道

第三方入口 ≠ OpenAI 官方帳號體系;上傳商業素材前請閱讀該入口的隱私與資料說明。國內存取細節見 國內使用完全指南。

常見問題

GPT Image 2 和 ChatGPT 裡的「出圖」是同一個嗎?

ChatGPT 內的圖像能力通常由當前預設圖像模型驅動;產品展示名可能寫作 Images/GPT Image 等。要以你帳號裡實際可選模型與 Platform 文件 的 gpt-image-2 說明為準,並記錄核對日期。

什麼時候必須繼續用 1.5,而不是直接上 2?

當流水線、快照或合規要求釘死舊模型 ID,或需要與歷史批次做像素級對照時,可暫留 1.5。新交付預設用 2,遷移步驟見 1.5 選型與遷移。

能不能一輪要求「最高 quality+完美文字+多張參考全跟」?

不建議。拆成構圖 → 參考約束 → 文字 → 尺寸/quality,失敗可定位,也更省額度。多輪越改越崩時,回到構圖正確的版本分支,或新開對話附上滿意幀作參考。

價格和限流是多少?

不寫死單價與配額。見 platform.openai.com 與當前帳號頁面當日說明。

官方資源

延伸閱讀

總結

GPT Image 2 是日常出圖的旗艦預設檔:相對 1.5 更適合定稿、改圖與短標題文字;尺寸與 quality 以文件當日為準,不要寫死。用驗收單驅動提示詞,先構圖再單點修改,文字能後置就後置,交付前跑完檢查清單。

相關內容