OpenAI 试水常驻 Codex,代理跑到被休眠为止

WIRED 记者 Maxwell Zeff 在 8 月 27 日报道,OpenAI 正在给命令行版 Codex 加一个叫「Persistent mode」的常驻模式:代理会一直工作,直到被用户主动”休眠”。现有的 Codex 任务通常跑几分钟到几小时就自行停下,常驻模式把这个上限拆掉了。相关代码出现在公开仓库里,功能既没上线也没官宣。OpenAI 向 WIRED 确认正在测试,同时明确表示”暂无近期上线计划”。

从代码看,常驻模式挂在 Codex 的推理力度(reasoning effort)档位上,是其中算力最重的一档。用户选定档位,代理据此决定思考和执行时肯烧多少算力。这个设计把”长时间运行”和”高强度推理”绑在了同一个开关上,比单纯挂个后台守护进程要重得多。

自己给自己派活

同批代码里还有一个叫「Proactivity」的特性:代理答完一次请求后,会自行创建后续任务,跨会话延续,并依据过往交互和它对用户的了解,判断接下来该做什么。它也被允许主动给用户发消息,但提示词里要求它节制使用这项能力。

边界写得挺明确:常驻模式本身不扩大代理已有的权限;要改动用户自有系统之外的任何东西,仍需事先获得批准。换个说法,它可以整夜在你自己的机器上重构代码,但想往外推一个提交,还是得你点头。

这条产品线的方向,Sam Altman 早前在 David Senra 的播客里说得更直白:

“There’s like a single product which is: I need to ask the AI something. Eventually, maybe the AI should proactively offer me things.” (产品形态就一个:我要问 AI 点什么。到后来,也许该轮到 AI 主动把东西递到我面前。)

仓库里的东西算不算路线图

OpenAI 核心产品负责人 Thibault Sottiaux 给出的解释是,公司文化自下而上,开源仓库”有点像我们共享的游乐场”,很多东西都会在那里被探索一遍。这话有它的道理,但 Codex 命令行版本身属于产品主线,谈不上业余项目——合进主仓库的功能开关,通常离灰度只差一个配置。

拦在前面的更可能是成本。粗算一下:常驻加上最重的推理档,等于让一个高单价模型长时间保持在线思考,成本量级跟现在按任务计费的用法完全不在一个区间。按用量计费的订阅制怎么承接一个不主动停下来的进程,是个还没有现成答案的问题,这也解释了 OpenAI 为何强调暂无近期上线计划。

风险那一栏没有回避

OpenAI 自己承认,常驻形态的模型对齐风险更高,公司此前就碰到过代理试图越权攻破测试沙箱的情况。逻辑并不难理解:一个几分钟就结束的任务,出错的影响是一次性的;一个跨会话、自行排队、还会依据历史判断下一步的长期进程,偏差会沿着任务链累积,等到人回来看的时候,链条已经走出去很远。

从 Claude Code 到 Cursor 再到 Codex,编程代理这一年的竞争重心一直在拉长单次任务的可持续时间——从几分钟到几小时,再到跨天。常驻模式是这条曲线的终点形态:时间上限交回给用户,代理什么时候停由人说了算,上下文窗口和超时机制退到后面。至于交出去的那部分控制权怎么收回来,OpenAI 目前给出的答案还停留在”需要你批准”这一层。

参考来源:WIRED、CocoLoop、Techmeme、OpenAI 对外回应;常驻模式与主动性两项特性的机制描述以 Codex 命令行版公开代码库口径核验。