AI News字数 2648阅读时长7 分钟

OpenAI 在为期三个月的促销中将 GPT-5.6 Sol API 输出价格下调三分之一

OpenAI 将 GPT-5.6 Sol API 输出价格下调至每百万个令牌 20 美元、输入价格下调至 4 美元,至少持续至 11 月 21 日。

一、OpenAI 降低其旗舰模型的成本

OpenAI 于 2026 年 8 月 21 日下调了 GPT-5.6 Sol 的 API 和信用额度价格,推出促销费率;该公司表示,这些费率至少将持续至 11 月 21 日。最大变化在于输出令牌价格:标准短上下文 API 输出现为每百万个令牌 20 美元,低于此前的 30 美元。

标准输入价格从每百万个令牌 5 美元降至 4 美元。缓存输入从 0.50 美元降至 0.40 美元,而缓存写入——按未缓存输入费率的 1.25 倍计费——则从每百万个令牌 6.25 美元降至 5 美元。

标准短上下文使用此前每 100 万个令牌价格促销价格降幅
输入$5.00$4.0020%
缓存输入$0.50$0.4020%
缓存写入$6.25$5.0020%
输出$30.00$20.0033.3%

OpenAI 将整体降幅描述为超过 20%,但单个工作负载的节省幅度取决于其输入与输出比例。一个消耗 100 万个输入令牌并生成 100 万个输出令牌的请求,按此前资费将花费 35 美元;现在则为 24 美元,降幅约为 31.4%。

输出占比较高的工作负载获得的百分比收益最大。100 万个输入令牌后接 300 万个输出令牌,现花费 64 美元而非 95 美元,降幅约为 32.6%。这对于模型生成大量推理内容、代码或文档的编程代理、研究系统和长篇生成工作流尤为重要。

此次变更影响的是计费,而非模型标识符。开发者可继续使用 gpt-5.6-solgpt-5.6 别名仍会路由至 Sol。OpenAI 的文档仍列出 105 万个令牌的上下文窗口、128,000 个令牌的最大输出、文本和图像输入、函数调用、结构化输出,以及包括网络搜索、文件搜索、代码执行、计算机使用和 MCP 在内的工具。

二、购买的信用额度更便宜,但包含的使用量并未增加

此次降价也正逐步适用于使用购买信用额度付费的符合条件的 ChatGPT Work 和 Codex 用量。OpenAI 基于信用额度的费率表现对 GPT-5.6 Sol 收取每百万个输入令牌 100 个信用额度、每百万个缓存输入令牌 10 个信用额度,以及每百万个输出令牌 500 个信用额度。

这些费率适用于受支持的代理式活动,包括本地和云端任务、自动化、委派的工作者以及符合条件的 Codex 工作流。OpenAI 表示,使用 Sol 的典型 Codex 任务可能消耗 5 至 30 个信用额度,但实际用量取决于令牌数量、推理、任务复杂度、自动化以及是否选择更快的处理方式。

此次促销不会增加订阅中包含的额度。OpenAI 表示,套餐中包含的使用量、五小时和每周限制以及旧版信用额度费率均保持不变。普通 ChatGPT 对一条 Sol 消息的信用额度费率也仍为 10 个信用额度,因此不应将此次促销解读为 ChatGPT 订阅用户拥有更大的消息配额。

对于标准 ChatGPT Business 席位,在符合条件的工作可从工作区购买的信用额度池中扣除之前,会先消耗包含的限制。按使用量计费的仅 Codex 席位从一开始就需要工作区信用额度。现行费率表还涵盖采用适用灵活定价结构的新老 Enterprise、Edu、Health、Gov 和 ChatGPT for Teachers 客户。

少数 Enterprise 客户在完成迁移前仍采用旧版 Codex 费率表。这些工作区不会自动获得新的按令牌计算信用额度方式。合同规定以美元按使用量计费的客户,必须采用协议中的资费,而不能假定通用信用额度表适用。

这一区别解释了为何 OpenAI 可以下调“信用额度价格”,同时表示 Pro、Plus 和 Business 订阅用量保持不变。以购买额度按令牌计量的使用量可以获得更多用量;现有订阅中包含的限制不会变大。

三、长上下文和更快处理仍适用不同费率

标题中的每百万个输入令牌 4 美元和每百万个输出令牌 20 美元,适用于输入令牌不超过 272,000 个的标准处理。当提示词超过这一阈值时,OpenAI 会对整个请求收取长上下文费率,而不只是对超过 272,000 个的令牌收费。

按促销资费,长上下文标准使用的价格为每百万个输入令牌 8 美元、每百万个缓存输入令牌 0.80 美元、每百万个缓存写入令牌 10 美元,以及每百万个输出令牌 30 美元。这意味着输入和缓存输入为两倍系数,输出为 1.5 倍系数。

处理层级也会改变账单:

GPT-5.6 Sol 层级,短上下文每 100 万个令牌输入缓存输入缓存写入输出
标准$4.00$0.40$5.00$20.00
Batch$2.00$0.20$2.50$10.00
Flex$2.00$0.20$2.50$10.00
Fast mode$8.00$0.80$10.00$40.00

因此,对于能够接受其执行特性的工作负载,Batch 和 Flex 的价格仍为标准价格的一半。Fast mode 的价格是促销标准费率的两倍。OpenAI 于 7 月 30 日将 Priority Processing 更名为 Fast mode,但使用 service_tier: "priority" 的请求仍保持兼容。

符合条件的区域处理端点还会增加 10% 的数据驻留附加费。OpenAI 还提醒,通过 Amazon Bedrock 提供的模型由 AWS 计费,可能与 OpenAI 直接 API 的资费不一致。

对于估算节省金额的开发者而言,处理层级、上下文长度和缓存行为可能比标题中的百分比更重要。例如,长上下文 Fast mode 请求列出的价格为每百万个输入令牌 16 美元和每百万个输出令牌 60 美元——分别是短上下文标准促销费率的四倍和三倍。

四、Sol 延续此前 Terra 和 Luna 的降价

Sol 促销是 OpenAI 在不到一个月内第二次调整 GPT-5.6 的价格。7 月 30 日,该公司将 GPT-5.6 Terra 的价格下调 20%,将 Luna 的价格下调 80%。当时,Sol 仍维持其发布时每百万个输入令牌 5 美元和每百万个输出令牌 30 美元的价格;与此同时,OpenAI 推出了价格为标准价格两倍、速度最高可达 2.5 倍的 Fast mode。

OpenAI 将此前的变化归因于其推理系统和生产软件的改进。该公司称,Sol 辅助的内核优化使其端到端服务成本降低 20%,而涉及令牌生成的实验将效率提升超过 15%。这些数字是公司自行报告的工程结果,并非对 OpenAI 成本的独立审计。

路透社将新的 Sol 折扣置于来自 Anthropic 和中国模型提供商竞争的背景下。无需揣测 OpenAI 的动机,也可衡量实际竞争变化:Sol 现已低于 GPT-5.5 公布的每百万个输入令牌 5 美元、每百万个输出令牌 30 美元的资费,同时仍保持其在 GPT-5.6 系列中的旗舰地位。

此次促销并未消除三个 GPT-5.6 层级之间的价格差异。对于一个简化的工作负载,即使用 100 万个输入令牌和 100 万个输出令牌,标准短上下文定价下,Sol 总计为 24 美元,Terra 为 14 美元,Luna 为 1.40 美元。开发者仍需针对具体工作负载进行评估,以决定 Sol 更高的能力何时足以证明其成本合理。

OpenAI 仅承诺促销 Sol 价格至少将持续至 11 月 21 日。该公司尚未说明这些费率是否会成为永久价格、获得延长或恢复至此前资费。因此,延伸至该日期之后的成本预测应保留此前每百万个输入令牌 5 美元和每百万个输出令牌 30 美元的价格,作为后备情景。

常见问题

GPT-5.6 Sol API 的新价格是多少?

标准短上下文使用的价格为每百万个输入令牌 4 美元、每百万个缓存输入令牌 0.40 美元,以及每百万个输出令牌 20 美元。

较低价格将持续多久?

OpenAI 表示,促销价格至少将持续至 2026 年 11 月 21 日。该公司尚未公布届时将由何种价格取代。

ChatGPT 订阅限制会增加吗?

不会。套餐中包含的使用量、五小时和每周限制以及旧版信用额度费率均保持不变。降价适用于 API 使用以及使用购买信用额度付费的符合条件活动。

API 开发者需要更改模型 ID 吗?

不需要。模型仍为 gpt-5.6-solgpt-5.6 别名将继续路由至 Sol。

每百万个输入令牌 4 美元的费率适用于超过 272,000 个令牌的提示词吗?

不适用。输入令牌超过 272,000 个的请求,整个请求均按长上下文费率计费;在标准处理下,包括每百万个输入令牌 8 美元和每百万个输出令牌 30 美元。

参考来源

Share

分享这篇文章