OpenAI abre beta pública da Agents API

Em 10 de setembro, a OpenAI lançou a beta pública da Agents API, aberta a todos os desenvolvedores. A empresa transformou o framework de execução de agentes que já roda por trás do Codex e do ChatGPT (chamado internamente de Codex harness) em um serviço gerenciado: todo o ciclo de chamadas ao modelo, uso de ferramentas e gestão de contexto passa a rodar na infraestrutura da OpenAI, enquanto o desenvolvedor decide quais capacidades o agente pode usar e onde o código é executado.

Na cobrança, a OpenAI não adiciona taxa de plataforma, o desenvolvedor paga apenas por token, chamadas de ferramentas e tempo de contêiner. O sandbox gerenciado é cobrado pela tarifa padrão de contêiner, e o uso do modelo é cobrado à parte pelo preço da API; o anúncio não detalha um valor específico para o sandbox.

Quatro recursos já embutidos

Segundo a OpenAI, a API já vem com itens que antes o desenvolvedor precisava construir sozinho:

  • Compactação automática de contexto: quando a sessão se aproxima do limite de contexto, o conteúdo mais antigo é compactado automaticamente;
  • Busca de ferramentas: as definições de ferramentas só são carregadas quando usadas, economizando token e custo;
  • Chamadas programáticas de ferramentas: com suporte a chamadas paralelas e encadeadas;
  • Múltiplos agentes: o agente principal pode dividir tarefas complexas entre subagentes independentes.

Há três opções de ambiente de execução. A primeira é o sandbox hospedado pela OpenAI, onde é possível pré-carregar arquivos, instalar dependências e conectar skills e plugins, permitindo que o agente execute código, processe arquivos e gere entregáveis. A segunda é conectar via WebSocket à própria máquina. A terceira é usar o sandbox de um parceiro; a lista traz nove nomes: Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop e Vercel.

Números dos primeiros clientes

A OpenAI apresentou resultados de alguns clientes iniciais. A pontuação de avaliação da Ciridae subiu de 0,71 para 0,85, e a latência do fluxo de subagentes caiu a um quarto do valor anterior; a SafetyKit reduziu custos em 60% após a migração; a Hypha teve queda de 86% nas respostas com falha; a Nash.ai opera milhares de agentes de longa duração em sua rede logística global.

Todos esses números foram informados pelos próprios clientes e divulgados pela OpenAI, sem verificação de terceiros. O anúncio não explica qual solução cada empresa usava antes da migração nem como a linha de base foi definida, então os números não devem ser comparados diretamente entre si.

As três gerações da interface de agentes da OpenAI

Colocando o lançamento na linha de produtos da própria OpenAI, o percurso fica mais claro.

No fim de 2023, a OpenAI lançou a Assistants API, que empacotava threads de conversa, busca em arquivos e interpretador de código em um estado gerenciado no servidor — bastava chamar a API, mas o preço era uma caixa-preta maior e depuração mais difícil; várias equipes usaram por um tempo e depois voltaram a montar suas próprias soluções. Em março de 2025, veio a Responses API junto com o Agents SDK de código aberto, devolvendo ao desenvolvedor a gestão de estado e a lógica de orquestração, escritas em seu próprio código. Em outubro do mesmo ano, o AgentKit acrescentou orquestração visual e ferramentas de avaliação.

A Agents API recua um passo: o ciclo volta a rodar nos servidores da OpenAI, mas o ambiente de execução é aberto a terceiros e a máquinas próprias. O que nas duas gerações anteriores o desenvolvedor precisava montar sozinho — escalonamento, compactação, sandbox — agora vem como configuração padrão.

A partir desse posicionamento, fica claro que o framework por trás do Codex já não atende apenas cenários de programação; a OpenAI está oferecendo diretamente ao público o que já usava internamente. O que o desenvolvedor economiza em esforço de orquestração, paga em maior dependência do runtime da OpenAI: quantos logs ficam visíveis quando o ciclo gerenciado falha, e se é possível exportar o trace completo, ainda não é detalhado na documentação da beta.

A OpenAI afirma que, durante a beta pública, vai iterar rapidamente com base no feedback dos desenvolvedores antes de avançar para a versão final. Quando essa versão chegará e se o modelo de cobrança vai mudar ainda não foi divulgado.

Fontes: anúncio oficial da OpenAI, CocoLoop, comunidade de desenvolvedores da OpenAI, MarkTechPost; modelo de cobrança, lista de sandboxes parceiros e dados de clientes iniciais verificados conforme o anúncio da OpenAI.