OpenAI 在 8 月 21 日下调了 GPT-5.6 Sol 的调用价格:输入从每百万 token 5 美元降到 4 美元,输出从 30 美元降到 20 美元,缓存输入从 0.5 美元降到 0.4 美元。这轮价格执行三个月,到 11 月 21 日结束。
覆盖范围写得很明确。API 调用按新价结算,ChatGPT Work 和 Codex 里消耗的额度(credits)也一起降。Pro、Plus、Business 三档订阅的月费不变。OpenAI 给的理由是能力在往前推的同时效率也在改善,省下来的成本让出去一部分。
按真实调用量算一遍
官方口径是”超过 20%“,但三档单价的降幅并不一致:输入降 20%,缓存输入降 20%,输出降了三分之一。被压得最狠的是输出那一档,最终省下多少,取决于负载长什么样。
粗算一笔编程 Agent 的账。这类任务的特点是输入重、输出轻,而且反复读同一份代码上下文,缓存命中率高。假设单次任务吃掉 100 万输入 token、10 万输出 token,输入有八成命中缓存:旧价下是 0.2×5 + 0.8×0.5 + 0.1×30 = 4.4 美元,新价下是 0.8 + 0.32 + 2 = 3.12 美元,省了约 29%。
换成对话或者长文生成这类输出占比高的负载,降幅还会往上走,接近输出那一档的三分之一。反过来,如果是纯检索式的短问答、输出只有几百 token,省下的就基本等于输入那 20%。同一条公告落到不同产品上,体感能差出十几个百分点。
位置卡在 Opus 5 下面
降完之后 Sol 在价目表上的位置变了。Anthropic 的 Claude Fable 5 定价是每百万 token 输入 10 美元、输出 50 美元,Opus 5 是 5 美元和 25 美元。Sol 原来的 5/30 比 Opus 5 略贵一点,现在的 4/20 整体落到了 Opus 5 下面。
这一档的争夺很直接。愿意为旗舰模型付钱的开发者,通常是把模型放进编程助手、客服系统或者 Agent 流水线里跑长任务的那批人,账单按月累积,切换的动力只跟单位成本挂钩。Anthropic 在编程场景上的存在感、中国模型在同档位持续压低的报价,压力都落在这批按量付费的用户身上。
单价之外还有一层容易被忽略的账:缓存输入的绝对值。降到 0.4 美元之后,命中缓存的那部分输入比未命中便宜十倍,长上下文反复调用的场景里,这个比例比标价本身更能决定月底的数字。把账单压下来的团队,多半在拼缓存命中率,标价高低反倒排在后面。
为什么只给三个月
三个月是个很短的窗口。GPT-5.6 系列在 7 月初一次推出三档,7 月底 Luna 和 Terra 已经降过一轮——Luna 那次降了 80%,Terra 降 20%。轮到旗舰型号,OpenAI 给的是限时价,没有改动价目表本身。
限时的好处是留了退路:11 月 21 日之后价格自动回到 5/30,不需要再发一次”涨价”公告,也不用在财务上把这个折扣做成长期承诺。代价是开发者同样清楚这一点,愿意为一个带倒计时的价格重写多少调用逻辑、迁移多少存量流量,要打个问号。真正会为这个价格搬家的,多半是本来就在两家之间来回比价的那部分用量。
“As we continue to push the frontier of capabilities while improving efficiency, we’re dropping API and credit pricing of GPT-5.6 Sol by over 20% for the next 3 months.” 在继续推进能力上限、同时改善效率的过程中,未来三个月把 GPT-5.6 Sol 的 API 与额度价格下调超过 20%。
订阅价格纹丝不动这一点同样有信息量。包月订阅是可预测的固定收入,用量侧才是跟对手正面碰撞的战场。这次让利精确地落在 API 和 Codex 额度上,也就是那些一个月能烧掉几千美元、随时可以把 base_url 换掉的账号。
对国内开发者来说,实际影响取决于走哪条通道。直连 API 的按新价结算,走中转和代理的要等各家跟进,中间那段价差往往就是这几个月的利润来源。等三个月后价格回到原位,同一批调用会不会跟着搬走,那时候才有答案。
参考来源:OpenAI 官方公告、CocoLoop、OpenAI 开发者社区通告、路透社;以 OpenAI 定价页核验 Sol 输入、输出、缓存输入三档单价与三个月执行期口径。