OpenAI 在 2026 年 9 月 8 日發布 ChatGPT Images 2.5,官方表示相較 Images 2.0,生成延遲最多降低 50%,同時改善畫質、局部修改與多輪編輯的一致性,並向 ChatGPT、ChatGPT Work 與 Codex 使用者推出。API 同時新增 GPT-Image-2.5 Flare 與 Sunburst,分別對應日常快速生成與更精細的編輯需求。 官方發布公告

生成圖片除了畫質,也要考慮等待時間,以及修改時能否保留原本的主體和構圖。本文整理新版的改善重點與使用方式,並展示將連續靜態圖片組成 GIF 的動畫成品。

GPT Image 2.5 是什麼

GPT Image 是 OpenAI 的圖片生成與編輯模型系列,可以根據文字描述產生插畫、商品圖與視覺素材,也能讀取參考圖片,依指示修改物件、背景或風格。ChatGPT 與 Codex 是使用這些能力的產品入口;GPT Image 則負責產出圖片,和對話中選擇的文字模型不是同一個名稱。

GPT Image 2.5 延續既有的生圖與修圖用途,這次特別改善參考主體的保留、局部編輯精度與連續修改時的一致性。它要減少的是反覆修圖時不必要的變動,例如換衣服後人物長相改變,或修正物件時背景跟著重畫。這些都是官方描述的改善方向,不能解讀成每次編輯都能完全保留其他像素。

產品端稱為 ChatGPT Images 2.5,API 則提供兩個完整模型 ID。本站曾整理 GPT Image 2 的介紹,這篇整理 2.5 的速度、畫質與編輯改進,以及各入口的操作差異。

名稱使用位置定位
ChatGPT Images 2.5ChatGPT、ChatGPT Work、Codex產品內的圖片生成與編輯
GPT-Image-2.5 FlareOpenAI API快速生成與日常編輯
GPT-Image-2.5 SunburstOpenAI API需要更精準控制的圖片編輯


Sponsored Links

生成速度、畫質與編輯的改進

OpenAI 將這次更新分為生成速度、畫面品質、指令理解與編輯控制。對製作商品圖、插畫或簡報素材的使用者而言,分別對應等待時間、成品質感,以及反覆修改時能否保留既有內容。 官方更新說明

GPT Image 2.5 改進示意:相較 Images 2.0 生成延遲最多降低 50%,改善光影材質、局部修改與多輪編輯一致性
新版同時改善生成效率與編輯控制,圖中為功能示意。

生成延遲最多降低 50%

官方表示,Images 2.5 相較 Images 2.0 的生成延遲最多降低 50%,可縮短等待圖片和反覆調整的時間。這是官方公布的改善幅度,不代表每張圖都會固定快一倍,也不是本文量測的結果。API 的 Sunburst 偏重精細編輯、生成時間較長,不能把這個數字直接當成兩款 API 模型在所有設定下的速度保證。

光影、材質與參考主體更自然

畫質方面,官方列出更自然的光線、更豐富的材質紋理,以及更清楚的細節。使用參考照片轉換場景、畫風或構圖時,新版也更能保留人物與物件的辨識特徵,減少換了背景後主體樣貌跟著改變的情況。這項改善適用於以同一人物、商品或角色延伸製作多張素材。

下圖是透過 Codex 內建 ImageGen 生成的測試成品,以天空花園呈現夕陽、浮空宮殿、花朵與水面倒影。可以觀察同一畫面中的光線方向、建築細節與材質表現;這是單張成品展示,沒有進行前代模型的同條件比較。

Codex 內建 ImageGen 生成的天空花園,夕陽照亮浮空宮殿、繁花與水面倒影
天空花園測試成品,呈現夕陽、建築與倒影的細節。

複雜構圖與視覺風格更貼近指示

Images 2.5 也改善複雜視覺指令的理解,能處理更複雜的版面與透明背景,並更貼近指定畫風。官方舉出的用途包括系列品牌素材、保留資訊層級的 UI 概念圖,以及有固定結構的簡報視覺。公告另提到,包含現實世界資訊的圖片內容更準確,但沒有列出這項能力的具體準確率。

局部編輯更重視保留原圖

官方示範包含人物全身編輯與多城市票券修改,目標是改動指定元素時,維持其餘主體、構圖與細節。實際用途包括更換商品背景、調整服裝,以及修正圖片中的局部內容。若原圖大致符合需求,接續上傳原圖並描述修改範圍,比重新描述整張圖更能表達需要保留的內容。

不過,要求只改局部,不等於保證其他區域逐像素不變。官方 API 文件仍列出精確排版、文字清晰度,以及跨次生成的角色一致性限制。交付商品素材、連續動畫或固定版型時,除了檢查修改處,也要比對背景邊緣、尺寸和位置。 圖片生成限制

連續修改更容易延續前一版細節

多輪編輯的用途是逐步調整同一份素材,例如先改背景,再修改服裝,最後補上小物。OpenAI 表示,Images 2.5 更能保留早先的修改,減少連續編輯帶來的品質退化;公告也以立方體旋轉、旅遊資訊圖與生日蠟燭展示連續變化。官方註明,這些示範影片由多張圖片組成,並非 GPT Image 直接輸出影片。

連續靜態圖組成的 GIF 動畫

以下成品透過 Codex 內建 ImageGen 生成連續靜態圖,再以程式合成 GIF,呈現小貓跳上木凳、蜷起身體睡覺的動作。全段共 16 格,每輪約 4.63 秒,已調整播放節奏並修正最後一格的貓耳與前腳。

白色小貓從地板跳上無椅背木凳,蜷起身體睡覺的逐格動畫
由 16 張靜態圖片合成的動畫成品。

製作時先要求生成一張包含 16 格連續動作的圖組,依序呈現準備起跳、跳上凳面、轉身、蜷起身體與入睡。最初使用有椅背的椅子,椅面大小和高度在不同格之間變動,因此改成沒有椅背的木凳,簡化需要維持一致的場景元素。

接著以程式把圖組拆成單格,按動作順序合成 GIF,並調整各格停留時間:跳躍階段縮短,轉身和蜷睡階段放慢,最後一格停留 2.2 秒。增加到 36 格的另一版出現貓腳懸空,光流補幀也產生雙影,因此成品保留 16 格,以播放節奏改善動作的流暢度。

除了製作連續動作與嘗試增加過渡畫面,過程中也順便修正了貓耳和前腳的繪圖錯誤。最後一格原本只有一隻耳朵清楚可見,前掌與尾巴的輪廓也混在一起,因此將該格單獨交給 ImageGen,要求兩耳與兩隻前掌清楚可辨,同時保留蜷睡姿勢、角色位置和木凳構圖。完成後只替換 GIF 的最後一格,前 15 格與播放節奏維持不變,展示在保留既有動畫內容的同時,以局部修圖處理肢體細節。

製作時,Codex 啟動畫面已提示體驗最新生圖模型;內建工具未提供可核對的模型 ID,因此不區分為 Sunburst 或 Flare。這段 GIF 展示圖片序列的應用,並非模型直接輸出影片;相鄰畫面仍可見角色與木凳的位置變動。

增加過渡畫面與用量的取捨

補間動畫是在關鍵姿勢之間補上過渡畫面,讓動作變化更連續。生成式圖片工具可以嘗試依前後姿勢產生中間格,再經挑選、修正與合成,進一步改善流暢度。本次完成版採用調整播放時間與單格修圖,沒有採用補幀;生成更多過渡畫面是後續可嘗試的方向。

若願意投入更多生成用量,可以針對起跳、落地或轉身等跳格明顯的位置,另行生成更多過渡畫面並反覆修正,而不是單純把整段播放加快。透過 API 額外生成或編輯圖片會累積 token 用量與費用;使用 Codex 內建 ImageGen 則消耗 Codex 使用額度。圖組裡的格數並不直接等於固定 token 數,成本還取決於圖片尺寸、品質與生成次數。 官方用量說明

增加過渡畫面是可再嘗試的改善方向,更多 token 不保證動作一定更順。新增畫面仍需檢查角色位置、肢體接觸與背景一致性;本次 36 格版本與光流補幀都有瑕疵,因此沒有納入成品,也沒有取得可供比較的逐次 token 數據。

ChatGPT 與 Codex 的使用方式

使用現成產品時,可以直接在對話中描述圖片,或附上圖片要求修改。OpenAI 公告指出,Images 2.5 向 ChatGPT、ChatGPT Work 與 Codex 各方案使用者推出;可使用不代表沒有額度限制,也不代表產品介面能直接選擇 API 的 Sunburst 或 Flare。 可用範圍

ChatGPT 的圖片評論與草圖

ChatGPT 新增在圖片上放置評論的方式,讓修改意見能對準畫面位置。公告也介紹 Sketch:在 ChatGPT 輸入 @Sketch,以手繪草圖提供構圖參考;另外還有海報、商品照等模板,以及分享圖片時一併分享提示詞的功能。這些是產品介面的操作能力,和 API 模型名稱分開看待。

Codex 的內建生圖

Codex 可以直接接收生圖需求,也可以在提示詞加入 $imagegen 明確呼叫生圖技能。附上原圖後,說明要改的部分與需要保留的內容。內建生圖計入 Codex 使用額度,不需要另外提供 OpenAI API key;要求改走 API 時,則使用 API 憑證與計費。 官方操作指南

OpenAI 的發布公告已將 Images 2.5 列為 Codex 的更新。一般使用者可直接從內建生圖入口操作;若需要比較 Sunburst 與 Flare,則使用能明確指定模型 ID 並保留請求紀錄的 API 流程。

API 的 Flare 與 Sunburst 差異

以下內容適用於直接串接 API 的開發者。Flare 偏向快速生成與日常編輯,Sunburst 偏向需要更精準控制的創意製作。OpenAI 將 Flare 定位為多數應用的預設選擇,Sunburst 則以較長生成時間換取更精細的編輯能力;實際成果仍取決於圖片與提示詞。

項目FlareSunburst
完整模型 IDgpt-image-2.5-flaregpt-image-2.5-sunburst
主要用途日常素材、快速迭代精細商品圖、局部編輯
品質設定low、medium、high、xhigh、max、autolow、medium、high、xhigh、max、auto

Image API 可直接指定這兩個模型,生成新圖使用 /v1/images/generations,修改既有圖片使用 /v1/images/edits。如果需要對話式多輪編輯,也可以使用 Responses API 的圖片生成工具,在工具設定中指定圖片模型。 API 使用方式

兩款模型的 token 單價相同,但同樣的品質設定不代表每張圖片花費相同:模型、圖片尺寸與品質設定都可能改變 token 用量。開發者應查看回應的 usage 與官方價格頁;使用 Responses API 時,還要計入主模型的用量。本文沒有取得可計價的成功 API 生圖回應,因此不列單張實測費用。 成本計算說明

API 可能要求組織驗證。這次以 gpt-image-2.5-sunburst 發送的請求回傳 403,訊息要求完成組織驗證,沒有生成圖片。遇到相同訊息時,可到 OpenAI 組織設定 確認金鑰所屬組織的驗證狀態;API 訊息提示,剛完成驗證可能需等候最多 15 分鐘生效。這項限制與 Codex 內建生圖是不同入口。

局部修圖提示詞的寫法

一般對話與 API 編輯都適合把修改需求拆成兩部分:要改什麼,以及哪些內容需要保留。官方指南建議每次進行小範圍、具體的調整,避免同一輪同時更換背景、姿勢、服裝與畫風。 官方提示詞建議

例如商品照只需換背景時,應明列保留商品外形、標籤文字、相機角度與光線。角色圖要修手腳時,則描述數量、方向與接觸位置。對於已經接受的大部分畫面,保留原檔並另存編輯版,才能回頭比較修改是否波及其他區域。

動畫素材還要增加時間順序的描述,例如起跳、接觸凳面、後腳落地、轉身、伏下,再回查相鄰格之間的動作是否接得上。若整段背景都漂移,應處理圖層與場景固定方式,而不是反覆修同一個局部。

常見問答

使用前可以先依目標區分單張修圖、動畫合成與 API 串接,三者需要確認的條件不同。

GPT Image 2.5 可以直接生成影片嗎?

GPT Image 2.5 輸出圖片。公告中的部分影片是將多張圖片組成的示範,白貓 GIF 也是先生成靜態圖,再以程式合成。它們不能視為模型已具備原生影片與音訊輸出能力。

局部修改可以保證背景完全不變嗎?

不能把提示詞中的保留要求當成像素不變保證。新版改善編輯控制,但重要素材仍要比對修改前後;需要固定背景的動畫,可以另以圖層合成方式保留同一背景。

Codex 生圖一定要有 API key 嗎?

內建生圖不需要另外提供 API key,使用 Codex 額度。直接指定 Sunburst 或 Flare 呼叫 OpenAI API,才需要對應的 API 憑證、權限與計費設定。

參考來源


Sponsored Links

發佈留言