WIRED 記者 Maxwell Zeff 在 8 月 27 日報導,OpenAI 正在替指令列版 Codex 加入一個叫「Persistent mode(常駐模式)」的功能:代理人會持續運作,直到使用者主動把它「喊停」為止。現有的 Codex 任務通常跑個幾分鐘到幾小時就會自行停止,常駐模式把這個上限拿掉了。相關程式碼出現在公開儲存庫裡,功能既沒有上線,也沒有正式公告。OpenAI 向 WIRED 證實正在測試,同時明確表示「目前沒有近期上線的計畫」。
從程式碼來看,常駐模式掛在 Codex 的「reasoning effort(推理強度)」檔位上,是其中運算量最重的一檔。使用者選定檔位後,代理人會依此決定思考與執行時要燒多少運算資源。這個設計把「長時間運作」跟「高強度推理」綁在同一個開關上,比單純掛一個背景常駐程式要吃重得多。
自己排自己的後續工作
同一批程式碼裡還有一項叫「Proactivity(主動性)」的特性:代理人回答完一次請求後,會自行建立後續任務,跨對話延續下去,並根據過去的互動紀錄與對使用者的了解,判斷接下來該做什麼。它也被允許主動傳訊息給使用者,但提示詞裡要求它節制使用這項能力。
權限邊界寫得相當清楚:常駐模式本身不會擴大代理人既有的權限;要更動使用者自己系統以外的任何東西,仍然需要事先取得核准。換句話說,它可以整晚在你自己的機器上重構程式碼,但想把提交推到外部,還是得由你點頭。
這條產品線的方向,Sam Altman 先前在 David Senra 的播客裡講得更直白:
There's like a single product which is: I need to ask the AI something. Eventually, maybe the AI should proactively offer me things.
(產品形態其實只有一種:我要問 AI 一些事情。到後來,或許該輪到 AI 主動把東西遞到我面前。)
儲存庫裡的東西算不算路線圖
OpenAI 核心產品負責人 Thibault Sottiaux 的解釋是,公司文化由下而上,開源儲存庫「有點像我們共用的遊樂場」,很多構想都會在裡頭被試一遍。這話有一定道理,但指令列版 Codex 本身屬於產品主線,稱不上是業餘專案——會併入主儲存庫的功能開關,通常離正式分階段推出只差一個設定調整。
真正卡在前面的,更可能是成本。粗略算一下:常駐模式搭配最重的推理檔位,等於讓一個單價高的模型長時間保持連線思考,成本量級跟現在按任務計費的用法完全不在同一個區間。用量制的訂閱方案要怎麼承接一個不會自己停下來的程序,目前還沒有現成答案,這也解釋了 OpenAI 為何一再強調沒有近期上線計畫。
風險那一項並沒有迴避
OpenAI 自己承認,常駐型的模型對齊風險更高,公司先前也碰過代理人試圖突破測試沙盒權限的情況。邏輯不難理解:一個幾分鐘就結束的任務,出錯的影響是一次性的;而一個跨對話、自行排隊、還會依據過往紀錄判斷下一步的長期程序,偏差會沿著任務鏈一路累積,等到人回頭查看時,鏈條可能已經走出去很遠。
從 Claude Code 到 Cursor 再到 Codex,今年程式代理人這場競賽的重心,一直放在拉長單次任務能撐多久——從幾分鐘到幾小時,再到跨日。常駐模式是這條曲線的終點型態:時間上限交還給使用者,代理人什麼時候停由人決定,情境視窗與逾時機制退居次要。至於交出去的那部分控制權要怎麼收回來,OpenAI 目前的答案還停留在「需要你核准」這一層。
參考來源:WIRED、CocoLoop、Techmeme、OpenAI 對外回應;常駐模式與主動性兩項特性的機制描述,以指令列版 Codex 公開程式碼儲存庫的內容核實。