Astra和Sol订阅版提速,输出到每秒50 token

OpenAI 把 GPT-6 Astra 和 GPT-6.1 Sol 在订阅产品里的默认输出速度提了一档。Codex 负责人 Thibault Sottiaux 10 月 5 日在社交平台宣布,两款模型的默认速度整体提升约 50%,输出速率从每秒约 30 个 token 提高到约 50 个,覆盖 OpenAI 自家所有产品,以及所有通过“Sign in with ChatGPT”接入的合作方应用。

用户不需要改任何设置。Sottiaux 说,更新会在两小时内陆续推到所有人手上。

第二天交出的“改进”

这次提速出现的时机不意外。10 月 4 日,Sottiaux 给 Codex 团队立了一个 28 天的公开期限:每天要么发布一项对多数 Codex 和 ChatGPT Work 用户有明显改善的东西,要么给所有人做一次完整的用量重置。

速度提升正好落在“多数用户都感受得到”这个标准里。它不挑场景,写代码、查资料、跑智能体任务都受益,也不需要用户学习新功能,在一场每天都要交作业的承诺里,这类改动最容易被认可。

覆盖范围也比只改 ChatGPT 大。Sottiaux 点名的合作方包括开源编程工具 OpenCode、Pi、Amp,以及 Cognition 的 Devin。这些产品允许用户直接拿 ChatGPT 订阅登录,调用的是订阅额度,不走 API 计费,所以订阅侧的提速会原样传到它们那里。

30 到 50,算出来不止一半

官方标题说“约 50%”,可按他给出的两个数字算,每秒 30 个 token 到 50 个,增幅约 67%。两种说法差在哪,Sottiaux 没有解释。一种可能是 50% 指端到端的整体体验,包含首个 token 的等待时间等环节,单看生成阶段才是三分之二。

换成用户能感受到的时间,做个粗算:

输出长度每秒 30 token每秒 50 token
一段 2000 token 的代码约 67 秒约 40 秒
一次 2 万 token 的智能体任务输出约 11 分钟约 6.7 分钟

这只算了模型吐字的时间。智能体任务里还有工具调用、跑测试、等网络的时间,这部分不会因为提速变短,所以实际完成一项任务省下的比例会低于表里的数。

分词器和 token 用量

Sottiaux 还提到,两款模型用上了优化过的分词器,完成同样任务所需的 token 数也减少了。具体少了多少,OpenAI 没有给数字。

这一点对订阅用户的影响可能比速度更直接。Codex 和 ChatGPT Work 的额度按 token 消耗计算,如果同一项任务少用 token,同样的额度就能多干一点活。反过来,单纯提速本身不改变额度:吐字快了,用户只是更早撞上五小时窗口的上限。有媒体在报道里专门指出了这一点。

GPT-6.1 Sol 9 月 29 日在 DevDay 上发布时,第三方测试发现它完成同样任务要比上一代多用 10% 到 30% 的输出 token。新分词器能把这部分抵消多少,要等独立测试重新跑一遍才知道。

API 侧暂无变化

两款模型的分工很清楚。GPT-6 Astra 是旗舰,API 标准价每百万输入 token 10 美元、输出 50 美元;GPT-6.1 Sol 主打编程智能体和电脑操作,输入 2 美元、输出 10 美元,两项都是 Astra 的五分之一。这次订阅侧提速,两款同时覆盖。

这次调整只涉及订阅产品里的默认速度。API 用户按 token 付费,速度是否同步变化,Sottiaux 的发言里没有提到,OpenAI 的 API 文档也暂未更新相关说明。

参考来源:Thibault Sottiaux 社交平台公开发言、CocoLoop、RuntimeWire、Crypto Briefing;输出速率以官方给出的每秒 token 数为准,增幅与耗时为按该口径推算。