AI TOOLS · SEPTEMBER 2026
QUICK ANSWER
ChatGPT Images 2.5 是 OpenAI 於美國時間 2026 年 9 月 8 日推出的最新生圖模型:生成延遲比 Images 2.0 最多降低 50%,參考照片裡的人物與寵物更像本人,多輪編輯不再改 A 壞 B。新功能 Sketch 讓你直接在 ChatGPT 裡手繪構圖草稿,Comment 讓你在圖上圈選要修改的位置。所有方案都能用,API 同步推出 Flare 與 Sunburst 兩個模型。
CHAPTER 01 · WHAT IS IT
今天一早打開社群,半個設計圈都在貼同一組九宮格海報。ChatGPT 的生圖功能升級到 Images 2.5 了——這是一個每週被拿來生成超過 30 億張圖的工具,所以它一改版,整個視覺工作流都會跟著晃一下。
官方給的定位是新一代 state-of-the-art 生圖模型:光線更自然、材質更豐富、參考照片裡的主體更容易被完整保留,多輪編輯時指令跟得更穩。生成延遲比 Images 2.0 最多降低 50%,等圖的時間直接砍半。
產品層一次加了四個新東西:Sketch 讓你直接在 ChatGPT 裡手繪草稿當構圖參考、Templates 提供海報與產品照等常用格式的起手模板、Comment 讓你把修改指令直接標在圖上、prompt 分享則讓別人能拿你的提示詞套自己的照片重跑一次。
這次開放的方式也很乾脆:ChatGPT、ChatGPT Work 與 Codex 的所有方案,桌機、手機、網頁全都拿得到,沒有等候名單。開發者端則同步推出 GPT‑Image‑2.5 Flare 與 GPT‑Image‑2.5 Sunburst 兩個 API 模型。距離 GPT‑6 Astra 上線還不到一週,OpenAI 這個九月的出牌節奏快得有點嚇人。
50%
延遲最多降低
30 億
每週生成張數
2
新 API 模型
CHAPTER 02 · WHY IT MATTERS
AI 生圖進設計流程這兩年,真正卡住大家的從來只有三件事。
第一件,人不像本人。丟一張客戶的品牌大使照片進去,換個場景,臉就悄悄變成陌生人;寵物更慘,換個姿勢直接換一隻狗。做人像相關的案子,這一關過不了,後面全免談。
第二件,改 A 壞 B。你說「把背景換成夜景」,它把背景換了,順便把主角的外套換色、logo 改字、光源整個重打。改到第五輪,畫質開始起沙,前三輪辛苦調好的細節一輪一輪流失。
第三件,只能用文字下指令。「左邊數來第二個杯子改成霧面藍」——設計師平常跟同事溝通是圈紅框、畫箭頭、丟草圖,跟 AI 溝通卻要退化回純文字作文,每一句都在翻譯自己的視覺直覺。
Images 2.5 這次的升級清單,三箭正好對著這三個痛點射。保真度對人不像本人,多輪一致性對改 A 壞 B,Sketch 與 Comment 對文字溝通損耗。這也是為什麼它值得設計師花十分鐘看完,而其他很多改版不值得。
“
改圖的語言,終於從一段文字描述,變回一支筆和一個紅圈。
CHAPTER 03 · HOW IT WORKS
先講模型本身,功能層下一章再說。官方公告把這次的能力提升拆成四塊,每一塊都能對回設計工作裡的某個具體時刻。
參考照片保真。丟參考照片進去換場景、換風格、換構圖時,主體的辨識度更高:五官與特徵更容易完整帶過去,光線與材質也更貼近真實。官方展示的案例包括嬰兒寫真重繪、寵物變裝與大頭照風格轉換,全都是過去最容易翻車的題型。
精準編輯。只動你指定的部分,其餘原封不動——即使主體與背景都很複雜。對接 API 的團隊來說,這代表可以單獨換掉一件商品、一塊背景或一段文案,而構圖、主體與品牌調性全部保留。
多輪一致性。長對話裡連續修改時,前面改好的東西更不容易被後面的指令弄壞,畫質也不再隨輪次劣化。每一輪都疊在上一輪的成果上,而非重新擲骰子。
理解力與風格。更能消化複雜的視覺指令:含真實世界資訊的圖內容更準確、支援更複雜的版面與透明背景、對指定視覺風格的還原度也更高。指令越具體,它越不容易中途走鐘——生成系列稿、UI 概念圖或簡報視覺時特別有感。
▲ 同一種能力的兩個極端:五〇年代復古未來插畫與磁磚馬賽克,材質語彙都咬得住(圖片來源:OpenAI)
CHAPTER 04 · GETTING STARTED
不用等、不用開通,打開 ChatGPT 直接生圖就是 2.5。真正該練的是這套新的工作節奏——把 Sketch、Templates 與 Comment 串成一條線用,而非各自單點。
丟參考照片,或從 Templates 起手
有明確主體就先上傳參考照片;沒方向就從海報、商品這類 Templates 模板挑一個,填上要傳達的資訊、設計元素與風格,省掉面對空白畫布的那五分鐘。
用 @Sketch 畫構圖草稿
在對話框輸入 @Sketch 就能開畫布。房間配置、服裝輪廓、版面骨架,隨手畫個大概,再補一句風格描述,它會把你的草稿當成構圖依據長出完整的圖。畫得醜完全沒關係,它要的是位置關係。
生成後用 Comment 圈選修改
第一版出來後,直接在圖上要改的位置留 comment,像改稿一樣點哪改哪。搭配多輪一致性,可以放心一輪一輪修,前面調好的部分會留在原地。
分享時連 prompt 一起給
滿意的成果可以連同提示詞一起分享,對方拿到的是可以重跑的配方,換上自己的照片與細節就能長出自己的版本。做團隊風格模板時特別好用。
官方的發布影片九十秒把主要功能都走了一遍,畫面比文字直覺:
CHAPTER 05 · IN PRACTICE
提案迭代。開會時客戶說「主視覺方向對了,但想看看夜間的氛圍」,過去這句話等於散會後再約一次;現在多輪編輯撐得住,你可以當場改給他看,而且改背景不會弄壞主體。會議的節奏會因此完全不同。
簡報視覺。理解力升級之後,含資訊結構的圖——流程圖解、步驟示意、含真實資訊的說明圖——準確度明顯拉高。簡報裡那頁「文字太多想換成圖」的內容,終於可以一句話換掉。
品牌系列稿。同一個主體跨場景、跨風格還能維持辨識度,代表 campaign 系列稿可以真的「系列」起來——同一位品牌大使出現在十張稿子裡,都還是同一個人。過去這件事要靠大量抽卡加後製硬拼。
產品圖換景。電商情境圖只換背景、不動商品本體,是精準編輯最直接的變現場景。API 端的 Flare 也已經被接進 Adobe Firefly、Runway 與 Manus 這些平台,你熟悉的工具裡很快就會出現它的身影——Adobe 與 ChatGPT 的整合本來就越走越近,之前的 Adobe for ChatGPT 已經把七十多個 Adobe 工具搬進了對話框。
CHAPTER 06 · LIMITS AND SAFETY
先潑一點冷水。保真度再高,AI 出圖的本質仍然是素材而非成品:邊緣、光影銜接、印刷條件的校色,這些收尾還是得進專業軟體做。它縮短的是從零到八十分的距離,最後二十分還是設計師的手。
生成的圖會帶 C2PA metadata 與隱形浮水印,用來辨識這是 AI 產出的內容——這已經是各家模型的標配做法,之前拆解過的 Claude 隱形浮水印機制 走的也是同一套邏輯。對設計師的實務意義是:交付給客戶的商用素材,AI 生成的事實在技術上是可被驗證的,別想著瞞。
NOTE
各方案的生成張數上限,官方這次沒有公布新數字。發布首日網路上流傳的各種額度數據都查不到官方來源,看到具體數字先存疑。
另外兩件實務上的責任歸屬:拿真人照片當參考素材,肖像權與授權要自己把關,模型變強不代表法律風險變小;生成內容含品牌元素時同理。工具解決的是產出效率,而非授權問題。
CHAPTER 07 · COMPARED TO
上市第一天,還沒有任何可信的公開對決數據,任何「誰贏了」的標題現在都是猜的。能講的是各家過往的體質:OpenAI 的模型一直強在圖內文字、密集版面與元素的精準擺放;Google 這一系則在寫實光影與皮膚質感上長期領先。Images 2.5 明顯是在把自己的強項疊得更高,同時補人像保真這塊短板。
至於 Midjourney,V8.2 成為預設模型之後藝術性與風格化仍然是它的主場,但它的編輯流程是另一套邏輯,跟 ChatGPT 這種對話式改稿走的是兩條路。整個生圖工具版圖怎麼選,可以回頭看 2026 年設計師的六大工具選型,這篇的結論在今天之後大概又要動一格了。
開發者選 API 的話,兩個新模型的分工很清楚:
CHAPTER 08 · TAKEAWAYS
TAKEAWAYS
→
Images 2.5 的三個核心升級——參考保真、精準編輯、多輪一致——正對著 AI 生圖進設計流程的三大痛點,而非灑花式的全面小改。
→
Sketch 與 Comment 把改圖從文字作文變回畫草稿、圈紅框,值得優先練熟,它們會改變你跟這個工具的對話方式。
→
全方案免等候開放、延遲砍半,拿它當日常打稿引擎的成本已經低到沒有理由不試。
→
產出仍是素材不是成品,收尾與授權責任都還在設計師手上;發布首日流傳的額度與勝負數據,先看過官方來源再信。
回頭看,這次最大的更動其實不在畫質,在「改圖的語言」。兩年來我們學著把視覺直覺翻譯成一段一段的文字咒語,練得再熟,那都是借來的語言。Sketch 與 Comment 把筆和紅圈還了回來——視覺溝通本來就是設計師的母語,工具終於開始講我們的話。接下來的差距,不在誰會寫 prompt,在誰的視覺判斷更準。而那件事,從來就沒有捷徑。
RELATED READS · 延伸閱讀
Midjourney V8.2 更新了什麼?成為預設模型一個月後,設計師該重測的三件事 →
生圖界另一頭的最新動態,跟 Images 2.5 走完全不同的路線
AI 插畫首選還是 Midjourney 嗎?2026 年設計師的六大工具選型 →
整個生圖工具版圖的選型指南,看完這篇再決定主力工具
單色印刷的海報,AI 做得出來嗎?mono-color skill 的兩塊印版、留白比例與七種字體角色 →
把 AI 生圖收斂成單一風格語彙的實戰示範
旅行手帳感插圖 prompt 特輯:上半實拍、下半手繪的雙格拆解 →
prompt 結構化的實例拆解,換到 Images 2.5 上一樣適用
Seedance 2.5 是什麼?30 秒一鏡到底的 AI 影片模型完整介紹 →
靜態圖之外,AI 影片這一側的版本號也剛好走到 2.5
合格很便宜,好看很貴:Sagmeister 訪談裡,AI 跨不過的那條線 →
工具越強,這篇談的「判斷力價值」就越值錢
EXTRA · LINKS
🌐 官方發布公告 → openai.com/index/introducing-chatgpt-images-2-5
✏️ 直接開 Sketch 畫布 → chatgpt.com/sketch
🛡️ 安全評估 system card → deploymentsafety.openai.com/chatgpt-images-2-5
💻 API 定價(Flare/Sunburst) → developers.openai.com/api/docs/pricing
FAQ
A:模型本身不用。Images 2.5 已對 ChatGPT、ChatGPT Work 與 Codex 的所有方案推送,含免費方案,桌機、手機、網頁都能用。各方案的生成張數上限依方案而異,官方這次沒有公布新的額度數字。
A:在 ChatGPT 對話框輸入 @Sketch 即可開啟畫布,或直接前往 chatgpt.com/sketch。畫好草稿後補一句風格與細節描述,模型會以草稿為構圖依據生成完整的圖。
A:Images 2.5 是 ChatGPT 產品內的名稱;Flare 與 Sunburst 是給開發者的兩個 API 模型。Flare 是預設選擇,品質提升同時延遲比 GPT‑Image‑2 低 50%;Sunburst 精度更高但生成時間較長,適合廣告成片這類高要求工作流。
A:官方數字是生成延遲比 Images 2.0 最多降低 50%。第三方平台 Manus 的早期評測甚至回報 Flare 的速度達到前代的二到四倍,但那是客戶端自己的量測,參考就好。
A:使用權依 OpenAI 的使用條款規範,但圖片會帶 C2PA metadata 與隱形浮水印,AI 生成的事實在技術上可被驗證。拿真人照片當參考素材時,肖像權與授權責任仍在使用者身上,商用前務必自行確認。
A:官方公告沒有提到 Images 2.0 或 GPT‑Image‑2 退役,無論是在 ChatGPT 內或 API 上。既有串接 GPT‑Image‑2 的服務目前可以照常運作,再視官方後續公告調整。