OpenAI 推出 ChatGPT Images 2.5 及 Flare 和 Sunburst API 模型
OpenAI 正推出 ChatGPT Images 2.5,並發佈 Flare 和 Sunburst API 模型,提供更快生成速度和更精準的編輯功能。
文章目錄 · 12
OpenAI 於 2026 年 9 月 8 日發佈 ChatGPT Images 2.5,距離推出 Images 2.0 不足五個月。公司表示,新版本可將圖像生成延遲最多降低 50%,同時提升參考相片的還原度、指定編輯能力,以及連續修訂之間的一致性。
此次推出涵蓋桌面、流動裝置及網頁上的所有 ChatGPT、ChatGPT Work 和 Codex 方案。OpenAI 亦推出兩款開發者模型:定位為日常應用程式較快預設選項的 GPT-Image-2.5 Flare,以及專為重視精確度多於生成時間的細緻創作和編輯工作而設的 GPT-Image-2.5 Sunburst。
這次發佈涉及的規模異常龐大。OpenAI 表示,用戶現時每週透過 ChatGPT Images 及其 GPT-Image API 模型創作超過 30 億張圖像。
一、Images 2.5 著重可重複進行的編輯
OpenAI 的主要主張關乎第一張圖像生成後的表現。Images 2.5 的目標是在修改指定元素時,毋須不必要地重繪周遭主體、構圖、背景或視覺處理。
這種行為針對早期圖像生成器的一項實際弱點:即使只是小幅修訂,也可能改變人物的臉部、產品的形狀、文字的位置,或其他用戶希望保留的細節。OpenAI 表示,Images 2.5 更擅長保留參考相片中可辨識的主體,並在多輪編輯期間維持先前的改動。
公司亦稱,系統提供更自然的光線、更豐富的質感、更準確地運用現實世界資訊,以及更佳地處理複雜版面。OpenAI 特別指出,透明背景、品牌素材系列、簡報圖像、用戶介面概念及產品圖像,均是預期可受惠的工作負載。
這些主要是供應商的主張,而非已發佈比較基準測試的結果。Axios 早期親身測試了貓咪相片、紋身設計和標誌。其記者發現,系統保留了貓咪的相似特徵,並支援細緻、在視覺上具針對性的修訂,為編輯功能的主張提供有限的獨立支持,但未有量化測量所稱的延遲降低幅度。
二、草圖、留言和範本改變介面
Images 2.5 在 ChatGPT 內加入四項創作及分享功能:Sketch、範本、圖像留言和可分享提示詞。
Sketch 讓用戶可直接在 ChatGPT 繪製粗略的視覺參考,並配合文字描述。輸入 @Sketch 可啟用此功能,不過 OpenAI 的發佈說明將初始流動版流程描述為輸入 @ 後選擇 Sketch。繪圖可傳達空間資訊,例如衣物輪廓、房間佈局或物件位置;這些資訊單靠文字指定或會較為繁複。
範本為海報、商品、傳單和產品相片等格式提供預設起點。用戶只需提供訊息、所需風格及其他細節,無須由空白輸入欄建立完整提示詞。ChatGPT 或會在生成圖像前提出跟進問題。
留言提供更局部的編輯流程。在支援的流動介面上,用戶可開啟圖像、標示希望更改的範圍,並在該位置附上指示。提示詞分享讓圖像創作者可附上底層提示詞,讓另一名用戶以不同相片或細節加以改編。
此次推出附帶產品專屬限制。OpenAI 的發佈說明表示,儘管底層 Images 2.5 模型已可用於 ChatGPT Work,範本尚未在 Work 模式提供。現有圖像生成使用上限亦維持不變。部分介面元素,包括新的載入體驗,會因平台及推出狀態而有所不同。
三、Flare 和 Sunburst 為開發者提供兩個部署選項
API 發佈將 Images 2.5 系列分為兩款具名模型,而非只提供一款可調整品質設定的模型。
GPT-Image-2.5 Flare 是 OpenAI 為大多數應用程式推薦的預設選項。公司將它描述為適合社交內容、視覺搜尋、產品體驗、快速原型製作及高產量生成。OpenAI 聲稱,Flare 生成的圖像品質高於 GPT-Image-2,且延遲低 50%。
GPT-Image-2.5 Sunburst 是圖像生成和編輯方面能力更強的選項。它針對活動創意、精緻產品圖像,以及其他重視跨編輯保留細節多於完成時間的工作流程。OpenAI 沒有發佈 Sunburst 的數值延遲比較,並明確警告其生成時間較長。
開發者可使用識別碼 gpt-image-2.5-flare 和 gpt-image-2.5-sunburst 選擇模型。需要將行為鎖定在發佈版本的應用程式,可使用定日期快照 gpt-image-2.5-flare-2026-09-08 和 gpt-image-2.5-sunburst-2026-09-08。
兩款模型均接受文字和圖像輸入,並回傳圖像。它們可透過 Image API 直接用於獨立生成或編輯,亦可在 Responses API 的圖像生成工具內選用;後者更適合對話式工作流程,以及保留先前上下文的重複編輯。
這些模型在既有的 low、medium 和 high 品質設定之上新增 xhigh 和 max;auto 仍然可用。它們支援建議的正方形、橫向和直向尺寸,以及自訂尺寸。自訂寬度和高度必須為 16 的倍數,長闊比須介乎 1:3 與 3:1 之間,總像素須介乎 655,360 至 8,294,400,且任何一邊不得長於 3,840 像素。高於 2,560 乘 1,440 的解像度仍屬實驗性功能。
開發者在使用 GPT-Image 模型前,可能需要完成 API 組織驗證。輸出格式、壓縮、品質、尺寸,以及透明或不透明背景均可透過 API 設定。
四、兩款模型共用定價,但每張圖像成本未必相同
OpenAI 為 Flare 和 Sunburst 列出相同的 token 收費:每百萬個文字輸入 token 為 $5、每百萬個快取文字輸入 token 為 $1.25、每百萬個圖像輸入 token 為 $8、每百萬個快取圖像輸入 token 為 $2,以及每百萬個圖像輸出 token 為 $30。
相同的 token 收費並不保證兩款模型完成一張圖像的成本相同。token 用量可因模型、解像度和品質設定而異。使用 Responses API 的應用程式,亦須為協調圖像生成工具的主語言模型所消耗的 token 付費。串流傳送部分圖像時,每張回傳的部分圖像會額外增加 100 個圖像輸出 token。
開發者亦應留意文件存在不一致之處。OpenAI 的數值定價表列出 GPT-Image-2 的文字輸入 token 為每百萬個 $2.50、圖像輸入 token 為每百萬個 $4,以及圖像輸出 token 為每百萬個 $15,均為相應 GPT-Image-2.5 收費的一半。然而,Flare 和 Sunburst 的模型頁面仍載有一段文字說明,表示其 token 收費「match GPT Image 2.」
2.5 模型的數值價格,在各自的模型頁面、圖像生成指南和中央定價表之間一致。與 GPT-Image-2 的矛盾比較看來是文件錯誤,但 OpenAI 在發佈時尚未解決。將生產工作負載遷移的開發者,應依據已記錄的 API 使用量和帳單資料,而非假設 Flare 的較低延遲亦代表每張圖像成本較低。
五、更高真實感沿用既有來源追溯機制
OpenAI 表示,Images 2.5 繼續為生成圖像附加 C2PA 中繼資料及不可見浮水印。其安全系統會在生成前,以及顯示最終輸出前,同時檢查請求和圖像。
系統卡指出,提升真實感可能造成更具說服力的政治、色情及其他敏感深度偽造內容。OpenAI 描述了上游政策檢查、對文字與圖像組合輸入的審核,以及評估生成圖像的下游監控器。
在 OpenAI 的對抗性安全測試集中,導致不安全圖像被呈現的提示詞百分比,Sunburst 為 1.09%,Flare 為 1.41%,相比之下 Images 2.0 為 1.64%。這些數字並不估算正常使用時不安全請求或輸出的頻率:該評估刻意採用旨在誘發違反政策的提示詞。
OpenAI 進一步提醒,自動標籤可能包含錯誤,而類別樣本量會影響統計精確度。系統卡報告指出,「unsafe presented」結果的差異均未達到其聲稱的顯著性門檻。因此,結果記錄了安全機制的運作,但未能證實相較 Images 2.0 有具統計顯著性的整體安全改善。
常見問題
ChatGPT Images 2.5 何時推出?
OpenAI 於 2026 年 9 月 8 日宣布並開始推出。
哪些人可使用 Images 2.5?
它正於桌面、流動裝置和網頁上的所有 ChatGPT、ChatGPT Work 及 Codex 方案推出。個別介面功能的推出時間或會不同。
開發者應選擇哪款 API 模型?
OpenAI 建議將 Flare 用於快速、日常或高產量生成。Sunburst 則適用於編輯精確度比延遲更重要的細緻工作流程。
Sunburst 也比 GPT-Image-2 快 50% 嗎?
OpenAI 所提供的延遲降低 50% 比較,明確只適用於 Flare。它沒有發佈可與之比較的 Sunburst 數字,並表示 Sunburst 生成圖像所需時間較長。
ChatGPT Work 可使用範本嗎?
尚未可以。OpenAI 表示,Images 2.5 模型可在 Work 使用,但範本在推出時尚未於 Work 模式提供。
參考來源
Share