El 10 de septiembre, OpenAI lanzó la beta pública de la Agents API, abierta a todos los desarrolladores. La empresa convirtió el framework de ejecución de agentes que ya impulsa Codex y ChatGPT (llamado internamente Codex harness) en un servicio gestionado: todo el ciclo de llamadas al modelo, uso de herramientas y gestión de contexto se ejecuta en la infraestructura de OpenAI, mientras el desarrollador decide qué capacidades puede usar el agente y dónde se ejecuta el código.
En cuanto a precios, OpenAI no cobra una cuota adicional de plataforma, el desarrollador solo paga por token, llamadas a herramientas y tiempo de contenedor. El sandbox gestionado se factura a la tarifa estándar de contenedor, y el uso del modelo se cobra aparte según el precio de la API; el anuncio no detalla un precio específico para el sandbox.
Cuatro capacidades integradas
Según OpenAI, la API ya incluye varias cosas que antes el desarrollador tenía que construir por su cuenta:
- Compresión automática de contexto: cuando una sesión se acerca al límite de contexto, el contenido más antiguo se comprime automáticamente;
- Búsqueda de herramientas: las definiciones de herramientas solo se cargan cuando se usan, lo que ahorra tokens y costes;
- Llamadas programáticas a herramientas: con soporte para llamadas en paralelo y encadenadas;
- Múltiples agentes: el agente principal puede repartir tareas complejas entre subagentes independientes.
Hay tres opciones para el entorno de ejecución. La primera es un sandbox alojado por OpenAI, donde se pueden precargar archivos, instalar dependencias y conectar skills y plugins, para que el agente ejecute código, procese archivos y genere resultados. La segunda es conectarse por WebSocket a la propia máquina. La tercera es usar el sandbox de un socio; la lista incluye nueve nombres: Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop y Vercel.
Las cifras de los primeros clientes
OpenAI presentó resultados de varios clientes tempranos. La puntuación de evaluación de Ciridae subió de 0,71 a 0,85, y la latencia del flujo de subagentes se redujo a una cuarta parte de la anterior; SafetyKit redujo sus costes un 60% tras la migración; Hypha vio caer sus respuestas fallidas un 86%; Nash.ai opera miles de agentes de larga duración en su red logística global.
Todas estas cifras las reportaron los propios clientes y las publicó OpenAI, sin verificación de terceros. El anuncio no explica qué solución usaba cada empresa antes de migrar ni cómo se definió la línea base, así que estas cifras no deberían compararse directamente entre sí.
Tres generaciones de la interfaz de agentes de OpenAI
Si se sitúa este lanzamiento dentro de la propia línea de productos de OpenAI, el hilo conductor queda bastante claro.
A finales de 2023, OpenAI lanzó la Assistants API, que empaquetaba hilos de conversación, recuperación de archivos e intérprete de código en un estado gestionado en el servidor; bastaba con llamar a la API, pero el precio era más caja negra y depuración más difícil, y no pocos equipos, tras usarla un tiempo, volvieron a construir su propia solución. En marzo de 2025 llegó la Responses API junto con el Agents SDK de código abierto, que devolvió al desarrollador la gestión de estado y la lógica de orquestación, escritas en su propio código. En octubre del mismo año, AgentKit añadió orquestación visual y herramientas de evaluación.
La Agents API da un paso atrás: el ciclo vuelve a ejecutarse en los servidores de OpenAI, pero el entorno de ejecución se abre a terceros y a máquinas propias. Lo que en las dos generaciones anteriores el desarrollador tenía que montar por su cuenta —programación de tareas, compresión, sandbox— esta vez es la configuración por defecto.
Con este posicionamiento, queda claro que el framework detrás de Codex ya no sirve solo a escenarios de programación; OpenAI está sacando directamente al público algo que ya usaba internamente. Lo que el desarrollador ahorra en esfuerzo de orquestación lo paga con una dependencia más profunda del runtime de OpenAI: cuántos registros quedan visibles cuando falla el ciclo gestionado y si se puede exportar la traza completa es algo que la documentación de la beta aún no detalla.
OpenAI afirma que, durante la beta pública, iterará rápidamente según la retroalimentación de los desarrolladores antes de avanzar hacia la versión final. Cuándo llegará esa versión y si el modelo de precios cambiará entonces todavía no se ha anunciado.
Fuentes: anuncio oficial de OpenAI, CocoLoop, comunidad de desarrolladores de OpenAI, MarkTechPost; el modelo de precios, la lista de sandboxes de socios y los datos de clientes tempranos se verificaron según el anuncio de OpenAI.