No plano de US$ 200, cota da Claude e cerca de 5x a da OpenAI

A SemiAnalysis, instituto de pesquisa em semicondutores e IA, publicou em 5 de outubro um teste prático das cotas de assinatura com uma conclusão direta: no plano mensal de US$ 200, ao rodar cargas de trabalho de agentes com modelos de nível intermediário, o valor em API embutido na assinatura da Anthropic é mais de 5 vezes maior que o da OpenAI. Os modelos comparados foram Claude Opus 5.5 e GPT-6.1 Sol.

O relatório é assinado por Andrew Megalaa, Max Kan e Dylan Patel, e o teste cobriu assinaturas da Anthropic, OpenAI, Meta, SpaceXAI, MiniMax, Moonshot, Z.ai, além de dois produtos wrapper, Cursor e Cognition.

Como a cota foi medida

Nenhuma das duas empresas divulga quantos tokens cada cota de assinatura equivale; ambas mostram apenas um indicador percentual de uso, além de duas janelas de limite de taxa, de 5 horas e de 7 dias. O método da SemiAnalysis foi fazer a engenharia reversa: isolar separadamente os tokens de entrada, de escrita em cache, de leitura em cache e de saída, medir quanto cada tipo faz o indicador de uso se mover, converter as leituras das duas janelas no total de tokens disponíveis por mês e, por fim, transformar isso em dólares pelo preço oficial da API.

Segundo relato da Implicator, a equipe alimentou contas pagas, trecho por trecho, com o texto de "Guerra e Paz": usou tags aleatórias para forçar entradas totalmente novas, tags fixas para medir a taxa de acerto do cache e textos técnicos longos para forçar saídas longas, repetindo o processo até que a margem de erro ficasse dentro de mais ou menos 5%.

As duas empresas estão ajustando as cotas em direções opostas

O teste coincidiu justamente com um ajuste próprio de cada lado.

A OpenAI reabriu, em 30 de setembro, o plano Pro de US$ 200, passando a calcular a cota com base no gasto equivalente em API. Na época, Thibault Sottiaux, responsável pelo Codex, disse:

"If you do the math, it will net out at half the dollar in API spend compared to the old Pro $200 plan."
(Fazendo as contas, isso equivale a apenas metade do gasto em API do antigo plano Pro de US$ 200.)

Segundo o detalhe citado pela SemiAnalysis, a cota dessa faixa no Codex e no Work caiu de 20 vezes a do Plus para 10 vezes, e acima dela foi criado um novo plano Pro de US$ 500. O relatório descreve a abordagem da OpenAI como um corte direto nos limites de todas as faixas.

A Anthropic seguiu o caminho contrário: os preços de API de entrada e saída do Opus 5.5 caíram 20%, a leitura em cache caiu 60%, enquanto a cota de Opus no plano Max subiu cerca de 20% e no plano Pro, cerca de 50%. Segundo a análise do relatório, a forma como a Anthropic aperta a margem é elevar o consumo de cota do modelo topo de linha Fable em relação ao Opus, em vez de cortar a cota como um todo.

Por isso, o "5 vezes" aparece sobretudo na faixa de modelos intermediários. Na faixa topo de linha, a SemiAnalysis considera que a diferença de cota entre Fable 5.1 e GPT-6 Astra é pequena.

Uma conta rápida do custo da assinatura

O relatório traz uma dupla de proporções que ajuda a entender o quadro: as assinaturas representam cerca de 10% da receita da Anthropic, mas podem consumir mais de 40% da capacidade de inferência.

Fazendo uma conta simples com essas duas proporções: cada unidade de capacidade computacional usada pelas assinaturas gera cerca de 0,25 unidade de receita; cada unidade usada pela API e por outras linhas de negócio gera cerca de 1,5 unidade de receita. A diferença é de cerca de 6 vezes. É apenas uma estimativa simplificada com base nas proporções do relatório, sem considerar acertos de cache ou balanceamento entre horários de pico e vale, e a própria Anthropic nunca divulgou seus números internos.

Essa diferença ajuda a explicar duas coisas: por que a OpenAI prefere correr o risco de perder usuários a manter cotas altas; e por que a Anthropic aumenta a cota do Opus ao mesmo tempo em que eleva o fator de consumo do Fable. Para desenvolvedores que usam bastante o Claude Code, a assinatura ainda compensa muito mais do que pagar por uso - e por quanto tempo isso vai durar depende de até quando a Anthropic estiver disposta a subsidiar.

O que fica atrás do paywall

A parte pública do relatório termina na seção sobre assinaturas via wrappers de terceiros serem piores que as assinaturas oficiais, e a partir daí o conteúdo fica bloqueado por paywall; a versão pública não traz números sobre a diferença exata em produtos como Cursor e Devin. Os resultados medidos para assinaturas de empresas chinesas como MiniMax, Moonshot e Z.ai também são relatados de forma inconsistente por diferentes veículos, por isso não são citados aqui.

Vale ressaltar que esse tipo de teste prático depende da precisão do indicador de uso exibido, e as empresas podem ajustar o método de medição nos bastidores em qualquer momento. Nem a Anthropic nem a OpenAI responderam publicamente às conclusões do relatório.

Fontes: relatório de teste prático de cotas de assinatura da SemiAnalysis, Techmeme, CocoLoop, AI Weekly, Implicator; o "5 vezes" segue o valor equivalente em API do Opus 5.5 frente ao GPT-6.1 Sol no plano de US$ 200, e as proporções de capacidade de cômputo e receita são estimativas da SemiAnalysis.