Thibault Sottiaux, líder de engenharia da OpenAI, anunciou na noite de 24 de agosto (horário do Pacífico) que, a partir do dia seguinte, o limite de uso de cinco horas voltaria a valer para contas Plus tanto no ChatGPT Work quanto no Codex. O limite havia sido removido após o lançamento do GPT-5.6, quando os usuários Plus passaram a ter cota calculada por semana. As camadas Pro de 100 e 200 dólares não terão esse limite ativado nos próximos meses.
"Tomorrow we will bring back the 5h limit for Plus accounts across ChatGPT Work and Codex."
(Amanhã vamos reinstalar o limite de 5 horas para contas Plus no ChatGPT Work e no Codex.)
A justificativa dada por Sottiaux foi suavizar a carga computacional: "the 5h limit allows us to smoothen the load on our compute, allowing to keep the plan generous in terms of weekly usage" — a janela de cinco horas distribui melhor a carga, o que permite manter a cota semanal generosa. Outra motivação diz respeito a usuários novos: cotas semanais tendem a ser consumidas nos dois primeiros dias, deixando as pessoas confusas diante dos avisos de limite. Ao atingir o limite, o usuário pode esperar a janela ser reiniciada ou comprar créditos adicionais.
Os 3% de rebaixamento silencioso
Quase ao mesmo tempo, outro assunto ganhou força na comunidade de desenvolvedores. Desde 22 de agosto, usuários Plus relataram que, ao selecionar GPT-5.6 Sol ou Thinking no seletor de modelos, as respostas na verdade vinham do GPT-5.5-mini. Alguns identificaram um padrão: o nível Instant funcionava normalmente, o problema só aparecia nos níveis Medium e High; era possível reproduzi-lo trocando de navegador, de aplicativo móvel ou de rede celular, enquanto outra conta na mesma rede não apresentava o problema. A forma de verificação usada pela comunidade era abrir as ferramentas de desenvolvedor e checar diretamente se o campo resolved_model_slug na resposta correspondia ao esperado. O tópico principal acumulou 13 respostas, e quatro relatos relacionados somaram mais de quarenta respostas adicionais.
Em 26 de agosto, um líder de produto da OpenAI reconheceu publicamente o problema: cerca de 3% das interações Pro e Thinking haviam sido redirecionadas por engano para o GPT-5.5-mini, o problema já foi corrigido e um pedido de desculpas foi feito aos usuários afetados. Por ora, essa declaração só apareceu na conta pessoal de redes sociais dele, e ainda não consta na página oficial de status.
3% parece pouco, mas o ponto de impacto é aleatório. Para quem compra cota semanal, cair justamente na solicitação em que o modelo precisa reescrever um módulo inteiro é muito diferente de cair numa conversa casual. O mais complicado é que não há erro visível — a resposta rebaixada continua coerente, só um pouco mais rasa, e é difícil perceber a menos que alguém vá conferir o corpo da resposta.
Três níveis de assento deixam tudo claro
Na mesma semana, outra linha de preços entrou em vigor. A OpenAI abriu, em 10 de agosto, uma lista de espera para o assento premium do ChatGPT Business, encerrou as inscrições em 20 de agosto e lançou oficialmente o recurso nesta semana. O preço é de 125 dólares por pessoa ao mês, ou equivalente a 100 dólares por pessoa ao mês na cobrança anual; o assento padrão custa 25 dólares mensais, ou 20 dólares mensais no plano anual. O assento premium oferece cinco vezes o uso do assento padrão e não fica sujeito à janela de cinco horas; os dois tipos de assento podem ser distribuídos e reatribuídos livremente dentro do mesmo espaço de trabalho. A condição promocional: os primeiros 10 mil clientes Business elegíveis recebem 100 dólares em créditos de espaço de trabalho (2.500 créditos) a cada assento premium adicionado, até no máximo cinco assentos.
Colocando as três linhas de preço lado a lado, a lógica fica clara. Do assento padrão para o premium, a mensalidade sobe cinco vezes, o uso também sobe cinco vezes, e o preço por unidade de uso não muda — o valor extra compra exatamente a isenção do limite de cinco horas. O mesmo raciocínio vale do lado individual: o Plus, a 20 dólares por mês, tem a janela reinstalada, enquanto o Pro, a 100 dólares, fica sem restrição — o múltiplo continua sendo cinco. Em termos gerais, a OpenAI fixou o coeficiente de preço do produto "poder usar sem limites a qualquer momento" em cinco vezes, de forma consistente tanto para indivíduos quanto para equipes.
Para desenvolvedores na China, o impacto direto é limitado. A maioria usa a API ou intermediários de terceiros, e a janela de cinco horas afeta principalmente quem assina o Plus diretamente para rodar o Codex. Mais relevante é o próprio mecanismo de roteamento: quando uma empresa oferece simultaneamente três níveis de inferência — Pro, Thinking e mini — com custos que diferem várias vezes, e o poder de alocação fica do lado do servidor, a questão de "o nível pago corresponde ao nível escolhido" deixa de ser um detalhe técnico e passa a ser uma questão de cobrança. Desta vez foram 3%, algo detectado, reconhecido e corrigido; se da próxima vez será igualmente identificado depende de quantas pessoas estiverem dispostas a checar esse campo.
Fontes: 9to5Mac, CocoLoop, comunidade de desenvolvedores da OpenAI, página oficial de preços da OpenAI; verificados o alcance da reinstalação do limite de cinco horas, os preços mensal e anual dos assentos premium e padrão, e as condições de reprodução da falha de roteamento.