OpenAI 在三個月推廣期內將 GPT-5.6 Sol API 輸出定價下調三分之一
OpenAI 將 GPT-5.6 Sol API 輸出定價下調至每百萬個 token $20,輸入定價下調至 $4,優惠至少維持至 11 月 21 日。
一、OpenAI 降低其旗艦模型的成本
OpenAI 於 2026 年 8 月 21 日下調 GPT-5.6 Sol 的 API 及積分定價,推出公司表示至少會維持至 11 月 21 日的推廣費率。當中最大改動是輸出 token 價格:標準短上下文 API 輸出現時每百萬個 token 收費 $20,低於原來的 $30。
標準輸入價格由每百萬個 token $5 下調至 $4。快取輸入由 $0.50 降至 $0.40,而按未快取輸入費率 1.25 倍計費的快取寫入,則由每百萬個 token $6.25 降至 $5。
| 標準短上下文用量 | 原每百萬個 token 價格 | 推廣價格 | 降幅 |
|---|---|---|---|
| 輸入 | $5.00 | $4.00 | 20% |
| 快取輸入 | $0.50 | $0.40 | 20% |
| 快取寫入 | $6.25 | $5.00 | 20% |
| 輸出 | $30.00 | $20.00 | 33.3% |
OpenAI 形容整體降幅超過 20%,但個別工作負載的節省幅度取決於其輸入與輸出比例。一個消耗一百萬個輸入 token 並產生一百萬個輸出 token 的請求,按原有收費會是 $35,現時為 $24,減幅約為 31.4%。
輸出量較高的工作負載可獲得最大的百分比優惠。一百萬個輸入 token 加上三百萬個輸出 token,現時收費為 $64,而非 $95,減幅約為 32.6%。這對模型會產生大量推理內容、程式碼或文件的編碼代理、研究系統及長篇生成工作流程尤其重要。
此變更影響計費方式,而非模型識別碼。開發者可繼續使用 gpt-5.6-sol;gpt-5.6 別名仍會路由至 Sol。OpenAI 的文件仍列出 105 萬 token 上下文視窗、128,000 個 token 的最大輸出量、文字及圖像輸入、函式呼叫、結構化輸出,以及包括網頁搜尋、檔案搜尋、程式碼執行、電腦操作和 MCP 在內的工具。
二、購買積分變得更便宜,但已包含的用量不會增加
此減價亦正推展至以購買積分支付、符合資格的 ChatGPT Work 及 Codex 用量。OpenAI 的積分制費率表現時就 GPT-5.6 Sol 收取每百萬個輸入 token 100 積分、每百萬個快取輸入 token 10 積分,以及每百萬個輸出 token 500 積分。
這些費率適用於受支援的代理式活動,包括本機及雲端工作、自動化、委派工作者及符合資格的 Codex 工作流程。OpenAI 表示,一項使用 Sol 的典型 Codex 工作可能會消耗 5 至 30 積分,但實際數量取決於 token 用量、推理、工作複雜度、自動化,以及是否選擇較快處理。
推廣活動不會增加訂閱已包含的額度。OpenAI 表示,方案已包含的用量、五小時及每週限制,以及舊有積分費率維持不變。Sol 訊息的一般 ChatGPT 積分費率亦維持為 10 積分,因此不應把此推廣理解為 ChatGPT 訂閱者可使用更多訊息配額。
對於標準 ChatGPT Business 席位,已包含的限制會先被消耗,符合資格的工作其後才可從工作空間購買的積分池中扣除。按用量計費、僅限 Codex 的席位則從一開始便需要工作空間積分。現行費率表亦涵蓋使用適用彈性定價架構的新舊 Enterprise、Edu、Health、Gov 及 ChatGPT for Teachers 客戶。
少數 Enterprise 客戶在遷移前仍採用舊有 Codex 費率表。這些工作空間不會自動獲得新的按 token 計算積分方式。合約訂明以美元按用量計費的客戶,必須採用其協議中的費率,而不應假定一般積分表適用。
這項區別說明了為何 OpenAI 可以降低「積分定價」,同時表示 Pro、Plus 及 Business 訂閱用量維持不變。以購買積分按 token 計量的用量可以用得更遠;現有訂閱已包含的限制則不會變大。
三、長上下文及較快處理仍採用不同費率
標題所述的 $4 輸入及 $20 輸出價格,適用於輸入 token 不超過 272,000 個的標準處理。當提示超過該門檻,OpenAI 會就整個請求收取長上下文費率,而非只就超過 272,000 個的 token 收費。
按推廣費率,長上下文標準用量每百萬個輸入 token 收費 $8、每百萬個快取輸入 token 收費 $0.80、每百萬個快取寫入 token 收費 $10,以及每百萬個輸出 token 收費 $30。這相當於輸入及快取輸入的兩倍乘數,以及輸出的 1.5 倍乘數。
處理層級亦會改變帳單:
| GPT-5.6 Sol 層級,短上下文 | 每百萬個 token 輸入 | 快取輸入 | 快取寫入 | 輸出 |
|---|---|---|---|---|
| 標準 | $4.00 | $0.40 | $5.00 | $20.00 |
| 批次 | $2.00 | $0.20 | $2.50 | $10.00 |
| Flex | $2.00 | $0.20 | $2.50 | $10.00 |
| 快速模式 | $8.00 | $0.80 | $10.00 | $40.00 |
因此,對可接受其執行特性的工作負載而言,Batch 及 Flex 的費用仍是標準價格的一半。快速模式的費用是推廣標準費率的兩倍。OpenAI 於 7 月 30 日將 Priority Processing 改名為快速模式,但使用 service_tier: "priority" 的請求仍然相容。
符合資格的區域處理端點另有 10% 的資料駐留附加費。OpenAI 亦警告,透過 Amazon Bedrock 提供的模型由 AWS 計費,未必與 OpenAI 直接 API 的費率相同。
對估算節省金額的開發者而言,處理層級、上下文長度及快取行為可能比標題百分比更重要。例如,一項長上下文快速模式請求列出的費率為每百萬個輸入 token $16,以及每百萬個輸出 token $60,分別為短上下文標準推廣費率的四倍及三倍。
四、Sol 緊隨較早前 Terra 和 Luna 的減價
Sol 推廣是 OpenAI 不足一個月內第二次調整 GPT-5.6 定價。公司於 7 月 30 日將 GPT-5.6 Terra 定價下調 20%,並將 Luna 定價下調 80%。當時 Sol 仍維持推出時的每百萬個輸入 token $5 及每百萬個輸出 token $30 定價,而 OpenAI 同時推出費用為標準價格兩倍、速度最高可達 2.5 倍的快速模式。
OpenAI 將早前的改動歸因於其推理系統及生產軟件的整體改善。公司表示,Sol 輔助的核心最佳化令其端對端服務成本降低 20%,而涉及 token 生成的實驗將效率提升超過 15%。這些數字是公司自行報告的工程結果,並非對 OpenAI 成本的獨立審計。
Reuters 將新的 Sol 折扣置於與 Anthropic 及中國模型供應商競爭的脈絡中。毋須揣測 OpenAI 的動機,實際的競爭變化已可量化:Sol 現時較 GPT-5.5 公布的 $5 輸入及 $30 輸出費率更便宜,同時保留其在 GPT-5.6 系列中的旗艦地位。
推廣活動不會消除三個 GPT-5.6 層級之間的價格差異。對一個簡化工作負載而言,若使用一百萬個輸入及一百萬個輸出 token,標準短上下文定價下,Sol 合共為 $24、Terra 為 $14、Luna 為 $1.40。開發者仍需針對工作負載進行評估,以決定 Sol 較高的能力何時值得其成本。
OpenAI 僅承諾至少至 11 月 21 日提供 Sol 推廣定價。公司未有說明費率會否成為永久價格、獲延長,或回復至原有費率。因此,延伸至該日期以後的成本預測,應保留原來的 $5 輸入及 $30 輸出價格作為後備情境。
常見問題
GPT-5.6 Sol API 的新價格是多少?
標準短上下文用量每百萬個輸入 token 收費 $4、每百萬個快取輸入 token 收費 $0.40,以及每百萬個輸出 token 收費 $20。
較低價格會維持多久?
OpenAI 表示推廣定價至少會維持至 2026 年 11 月 21 日。公司尚未公布其後會採用甚麼安排。
ChatGPT 訂閱限制會增加嗎?
不會。方案已包含的用量、五小時及每週限制,以及舊有積分費率維持不變。減價適用於 API 用量及以購買積分支付的符合資格活動。
API 開發者需要更改模型 ID 嗎?
不需要。模型仍為 gpt-5.6-sol,而 gpt-5.6 別名會繼續路由至 Sol。
$4 輸入費率是否適用於超過 272,000 個 token 的提示?
不適用。輸入 token 超過 272,000 個的請求,整個請求均按長上下文費率收費;在標準處理下,包括每百萬個輸入 token $8 及每百萬個輸出 token $30。
參考來源
Share