OpenAI corta preço do GPT-5.6 Sol por tempo limitado, output cai um terço

Em 21 de agosto, a OpenAI reduziu os preços de chamada da API do GPT-5.6 Sol: o valor de entrada caiu de 5 para 4 dólares por milhão de tokens, o de saída de 30 para 20 dólares, e o de entrada em cache de 0,5 para 0,4 dólar. O novo preço vale por três meses, até 21 de novembro.

O escopo foi definido com clareza. As chamadas de API são cobradas no novo valor, e os créditos consumidos no ChatGPT Work e no Codex também caem junto. As mensalidades dos planos Pro, Plus e Business permanecem inalteradas. A justificativa da OpenAI é que a capacidade dos modelos continua avançando ao mesmo tempo em que a eficiência melhora, e parte da economia gerada é repassada.

Calculando pelo uso real

O discurso oficial fala em "mais de 20%", mas a redução não é igual nas três faixas de preço: entrada cai 20%, entrada em cache cai 20%, e a saída cai um terço. A faixa mais penalizada é a de saída, e quanto se economiza de fato depende do formato da carga de trabalho.

Uma conta rápida para um agente de programação. Esse tipo de tarefa costuma ter entrada pesada e saída leve, além de reler repetidamente o mesmo contexto de código, o que gera uma alta taxa de acerto de cache. Suponha uma tarefa que consome 1 milhão de tokens de entrada e 100 mil de saída, com 80% da entrada vindo do cache: no preço antigo, isso dá 0,2×5 + 0,8×0,5 + 0,1×30 = 4,4 dólares; no novo preço, 0,8 + 0,32 + 2 = 3,12 dólares, uma economia de cerca de 29%.

Em cargas com maior proporção de saída, como conversas ou geração de textos longos, a economia sobe ainda mais, aproximando-se do corte de um terço aplicado à saída. Por outro lado, em consultas curtas do tipo busca pura, com saída de apenas algumas centenas de tokens, a economia fica praticamente restrita aos 20% da entrada. O mesmo anúncio pode gerar diferenças de mais de dez pontos percentuais dependendo do produto.

Posição agora abaixo do Opus 5

Depois do corte, a posição do Sol na tabela de preços mudou. O Claude Fable 5, da Anthropic, cobra 10 dólares de entrada e 50 dólares de saída por milhão de tokens, enquanto o Opus 5 cobra 5 e 25 dólares. O antigo preço 5/30 do Sol ficava um pouco acima do Opus 5; o novo preço 4/20 agora fica, no geral, abaixo dele.

A disputa nessa faixa é direta. Os desenvolvedores dispostos a pagar por um modelo de topo costumam ser aqueles que rodam assistentes de programação, sistemas de atendimento ao cliente ou pipelines de agentes com tarefas longas; a conta se acumula mês a mês, e o incentivo para trocar depende apenas do custo por unidade. A presença da Anthropic no cenário de programação, somada à pressão constante de preços dos modelos chineses na mesma faixa, recai sobre esse grupo que paga por uso.

Além do preço unitário, há um detalhe fácil de ignorar: o valor absoluto da entrada em cache. Com o corte para 0,4 dólar, a parte que acerta o cache fica dez vezes mais barata do que a que não acerta; em cenários de chamadas repetidas com contexto longo, essa proporção pesa mais na conta final do mês do que o preço de tabela em si. As equipes que conseguem manter a conta baixa costumam apostar na taxa de acerto de cache, deixando o preço de tabela em segundo plano.

Por que apenas três meses

Três meses é uma janela bem curta. A série GPT-5.6 lançou três faixas de uma vez no início de julho, e no final do mês Luna e Terra já haviam recebido um corte de preço — Luna caiu 80% e Terra, 20%. Agora é a vez do modelo de topo, e a OpenAI oferece um preço por tempo limitado, sem alterar a tabela de preços original.

A vantagem do prazo é deixar uma saída: depois de 21 de novembro, o preço volta automaticamente para 5/30, sem precisar anunciar um novo "aumento" e sem precisar registrar esse desconto como um compromisso financeiro de longo prazo. O custo é que os desenvolvedores também sabem disso, então ainda fica em aberto quanto de lógica de chamada eles vão reescrever ou quanto de tráfego existente vão migrar por causa de um preço com contagem regressiva. Quem realmente migra por esse preço costuma ser justamente quem já compara os dois fornecedores o tempo todo.

"As we continue to push the frontier of capabilities while improving efficiency, we're dropping API and credit pricing of GPT-5.6 Sol by over 20% for the next 3 months."

O fato de o preço das assinaturas não se mexer também é revelador. A assinatura mensal é uma receita fixa e previsível, enquanto o lado do uso medido é o campo de batalha onde a empresa colide de frente com os concorrentes. Esse desconto atinge exatamente a API e os créditos do Codex — ou seja, as contas capazes de gastar milhares de dólares por mês e de trocar a base_url a qualquer momento.

Para os desenvolvedores na China, o impacto real depende de qual canal eles usam. Quem acessa a API diretamente já paga o novo preço; quem passa por revendedores ou proxies precisa esperar esses intermediários repassarem o corte, e a diferença de preço nesse meio-tempo costuma ser justamente a margem de lucro dos próximos meses. Só depois que o preço voltar ao normal em três meses é que se saberá se esse mesmo volume de chamadas vai migrar junto.

Fontes: comunicado oficial da OpenAI, CocoLoop, aviso da comunidade de desenvolvedores da OpenAI, Reuters; os três valores de entrada, saída e entrada em cache do Sol, além do período de três meses, foram conferidos na página de preços oficial da OpenAI.