OpenAI 9 月 10 日推出 Agents API 公测版,面向所有开发者开放。它把驱动 Codex 和 ChatGPT 的那套智能体运行框架(官方称 Codex harness)做成了托管服务:模型调用、工具使用、上下文管理这一整个循环由 OpenAI 在自家基础设施上跑,开发者决定智能体能用哪些能力、代码在哪里执行。
计费上不加平台费,开发者只为 token、工具调用和容器时长付钱。托管沙盒按标准容器费率计,模型用量另按 API 价格算,公告里没有单独列出沙盒单价。
四项内置能力
按 OpenAI 的说明,这个 API 自带几件以前要开发者自己写的东西:
- 自动上下文压缩:会话接近上下文上限时,自动压缩较早的内容;
- 工具搜索:工具定义用到时才加载,省 token,也省钱;
- 程序化工具调用:支持并行和链式调用;
- 多智能体:主智能体可以把复杂任务拆给独立的子智能体。
执行环境有三种选法。一是 OpenAI 托管的沙盒,里面可以预放文件、装依赖、挂技能和插件,智能体能跑代码、处理文件、产出成品。二是通过 WebSocket 接到自己的机器上。三是接合作方的沙盒,名单上有 Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop 和 Vercel 九家。
早期客户给的数字
OpenAI 列了几家早期用户的结果。Ciridae 的评测得分从 0.71 升到 0.85,子智能体流程的延迟降到原来的四分之一;SafetyKit 迁移后成本降了 60%;Hypha 的失败响应减少 86%;Nash.ai 在全球物流网络里跑着数千个长时运行的智能体。
这些都是客户自报、经 OpenAI 发布的数字,没有第三方复测。各家迁移前用的是什么方案、基线怎么定,公告没有交代,几组数字之间也不宜横着比。
OpenAI 的智能体接口走了三代
把这次放回 OpenAI 自己的产品线上看,脉络比较清楚。
2023 年底 OpenAI 推出 Assistants API,把对话线程、文件检索、代码解释器打包成服务端状态,开发者调接口就能用,代价是黑盒多、调试难,不少团队用了一阵又退回自己拼。2025 年 3 月换成 Responses API 加开源的 Agents SDK,状态管理和编排逻辑交还给开发者,写在自己的代码里。同年 10 月的 AgentKit 在上面加了可视化编排和评测工具。
Agents API 往回收了一步:循环重新放到 OpenAI 服务器上跑,执行环境却开放给第三方和自有机器。前两代要开发者自己搭的调度、压缩、沙盒,这次成了默认配置。
从这次的定位看,Codex 背后那套框架已经不只服务编程场景,OpenAI 把内部跑过的东西直接拿出来对外提供。开发者省下的是编排层的工程量,换来的是对 OpenAI 运行时更深的依赖:托管循环出了故障,排障能看到多少日志、能不能导出完整轨迹,公测文档里还没有展开。
OpenAI 表示公测期间会根据开发者反馈快速迭代,再推进到正式版。正式版什么时候来、届时计费方式会不会调整,目前都没有公布。
参考来源:OpenAI 官方公告、CocoLoop、OpenAI 开发者社区、MarkTechPost;OpenAI 公告核验计费方式、合作沙盒名单与早期客户数据。