GPT-6.1 Sol 上线,API 价格为 Astra 五分之一

OpenAI 在 9 月 29 日的 DevDay 上发布了 GPT-6.1 Sol,定位是编程智能体、电脑操作和专业办公任务。API 标准价每百万输入 token 2 美元、缓存输入 0.10 美元、输出 10 美元,和 GPT-6 Sol 持平;对照旗舰 GPT-6 Astra 的 10 美元、0.20 美元和 50 美元,输入输出两项都是五分之一。

发布节奏很密。GPT-6 Astra 是 26 天前上的,GPT-6 Sol 才上线 7 天,就被 6.1 版接替。按 OpenAI 的说法,新模型在编程和电脑操作上”接近 Astra”。

跑分贴近旗舰,个别项目差距还在

OpenAI 公布的成绩里,GPT-6.1 Sol 在 DeepSWE v1.1 上以较高推理档拿到 75.2%,和 Astra 打平,成本约为后者的五分之一。OSWorld 2.0 最高推理档得分 71.4%,比 Astra 低 2.1 个百分点,单任务成本约为其七分之一。在考察命令行科研流程的 Terminal-Bench Science 0.1 上,它每任务平均花 5.47 美元,Claude Opus 5.5 是 23.21 美元,Astra 是 23.80 美元。

第三方 Artificial Analysis 的独立测试给出了相近的结论:智能指数比 GPT-6 Sol 高 4 分,比 GPT-6 Astra 低 1 分;在知识准确度测试里,幻觉率从 60% 降到 54%。代价是话变多了,完成同样任务要多用 10% 到 30% 的输出 token。缓存读取折扣从 90% 提到 95%,部分抵消了这笔开销。

并非所有项目都贴得这么近。OpenAI 自己列出的数据中,内部版 ExploitBench 上 Sol 是 21.5%,Astra 是 31.5%;故障排查类的 TroubleshootingBench 上是 47.96% 对 63.46%。需要长链条排障的场景,旗舰仍有明显优势。

使用门槛和几条限制

GPT-6.1 Sol 已在 ChatGPT Work 和 Codex 向 Plus、Pro、Business、Enterprise、Edu 用户开放,免费版和 Go 用户暂时用不到,普通聊天界面也还没接入。开发者用 gpt-6.1-sol 调用,上下文窗口约 105 万 token,单次最多输出 12.8 万 token。

有几处细节需要留意:

  • 单次提示超过 27.2 万 token 的部分,输入按 2 倍、输出按 1.5 倍计价;
  • 不支持 none 和 minimal 两档推理强度;
  • 走 Chat Completions 接口时不能调用工具,要换到 Responses API。

第二条对做实时交互的团队影响最大。原来靠关掉推理换低延迟的调用方式,在 6.1 Sol 上行不通。

国内开发者能从哪里用到

OpenAI 官方 API 从 2024 年 7 月起就不向中国大陆提供服务,这一点没有变化。这次首发名单里的第三方渠道更贴近国内开发者的实际情况:OpenRouter、Vercel AI Gateway 同步上架,GitHub Copilot 的 Pro+、Max、Business、Enterprise 档也已可选。

对国内团队来说,更直接的参照是国产模型的价格带。GLM-5.3 此前公布的 API 价格是每百万输出 token 4.4 美元,不到 GPT-6.1 Sol 的一半。Sol 这次把旗舰级编程能力压到 10 美元一档,国产模型在编程场景里靠价格拉开的距离被收窄了一截,各家后面会不会跟着调价,还要再看。

另一个变量在 OpenAI 自己身上。它前一天刚撤下原定 10 月发布的 GPT-6.1 Astra,理由是安全性未达标,旗舰线的下一次更新时间还没有定。在此之前,6.1 Sol 大概率是 OpenAI 面向开发者主推的那个型号。

参考来源:OpenAI 官方发布页与 DevDay 回顾、Artificial Analysis 独立评测、CocoLoop、DataCamp 与 Vellum 评测整理;API 各档单价、上下文长度与长提示计费倍数以 OpenAI 公布口径为准。