OpenAI開放Agents API公測

OpenAI於9月10日推出Agents API公測版,開放給所有開發者使用。這套API把驅動Codex與ChatGPT的代理執行框架(OpenAI內部稱為Codex harness)做成了代管服務:模型呼叫、工具使用、上下文管理這一整套循環改由OpenAI在自家基礎架構上執行,開發者只需決定代理能用哪些功能、程式碼要在哪裡跑。

計價方式不額外收平台費。開發者只需為token、工具呼叫與容器執行時間付費。代管沙盒依標準容器費率計算,模型用量則另依API價格計費,公告中並未單獨列出沙盒的價格。

四項內建功能

根據OpenAI的說明,這套API內建了幾項過去得由開發者自行開發的功能:

  • 自動上下文壓縮:對話接近上下文上限時,會自動壓縮較早的內容;
  • 工具搜尋:工具定義在用到時才載入,節省token也省成本;
  • 程式化工具呼叫:支援平行與串聯呼叫;
  • 多代理協作:主代理可以把複雜任務拆給獨立的子代理處理。

執行環境有三種選擇。第一種是OpenAI代管的沙盒,可以預先放入檔案、安裝相依套件、掛載技能與外掛,讓代理能執行程式碼、處理檔案、產出成品。第二種是透過WebSocket接到自己的機器上執行。第三種是接上合作夥伴的沙盒,目前名單上有Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop與Vercel九家。

早期客戶提供的數字

OpenAI列出了幾家早期用戶的成果。Ciridae的評測分數從0.71升到0.85,子代理流程的延遲降到原本的四分之一;SafetyKit遷移後成本降低60%;Hypha的失敗回應減少86%;Nash.ai則在全球物流網路中同時執行數千個長時間運作的代理。

這些數字都是客戶自行提報、由OpenAI對外發布,並未經第三方複查。各家企業遷移前用的是什麼方案、基準值怎麼訂定,公告裡都沒有交代,這幾組數字也不適合直接橫向比較。

OpenAI的代理介面已走到第三代

把這次公測放回OpenAI自己的產品線來看,脈絡其實滿清楚的。

2023年底,OpenAI推出Assistants API,把對話串、檔案檢索、程式碼直譯器打包成伺服器端狀態,開發者呼叫API就能用,代價是黑盒子多、除錯困難,不少團隊用了一陣子後又退回自己搭建。2025年3月換成Responses API搭配開源的Agents SDK,狀態管理與編排邏輯交還給開發者,寫進自己的程式碼裡。同年10月推出的AgentKit則在上面加了視覺化編排與評測工具。

Agents API等於往回收了一步:循環重新放到OpenAI伺服器上執行,執行環境卻對第三方與自有機器開放。前兩代得由開發者自己搭建的排程、壓縮、沙盒,這次成了預設功能。

從這次的定位來看,撐起Codex的那套框架已經不只服務程式開發場景,OpenAI直接把內部使用的東西拿出來對外提供。開發者省下的是編排層的工程量,換來的則是對OpenAI執行環境更深的依賴:代管循環一旦出狀況,能看到多少日誌、能不能匯出完整追蹤紀錄,公測文件裡目前還沒有說明。

OpenAI表示,公測期間會依開發者的回饋快速迭代,再推進到正式版。正式版何時推出、屆時計價方式是否調整,目前都尚未公布。

參考來源:OpenAI官方公告、OpenAI開發者社群、CocoLoop、MarkTechPost;計價方式、合作沙盒名單與早期客戶數據均以OpenAI公告核對。