Claude Haiku 5.5 chega com entrada a 0,10 dólar

A Anthropic lançou o Claude Haiku 5.5 em 7 de outubro, o primeiro modelo pequeno da geração Claude 5 — o Haiku anterior ainda estava na versão 4.5. O novo modelo chegou no mesmo dia à Claude Platform e, simultaneamente, à AWS, Google Cloud e Microsoft Azure; o Claude Code também o incorporou em uma atualização lançada no mesmo dia.

O posicionamento oficial é bem específico: tarefas em lote de alto volume e o papel de subagente para modelos maiores. O preço é o protagonista deste lançamento.

Dois níveis de preço, divididos pelo tamanho do prompt

O Haiku 5.5 divide o preço em dois níveis conforme o tamanho de cada prompt, com 100 mil tokens como limite:

Por milhão de tokensHaiku 5.5 (≤100k)Haiku 5.5 (>100k)Haiku 4.5
EntradaUS$ 0,10US$ 0,50US$ 1,00
SaídaUS$ 0,50US$ 2,50US$ 5,00
Leitura de cacheUS$ 0,01US$ 0,05US$ 0,10
Escrita de cacheUS$ 0,125US$ 0,625US$ 1,25

No nível de prompt curto, todos os preços equivalem a um décimo dos do Haiku 4.5; no nível longo, à metade. Segundo a Anthropic, o custo operacional total cai, em média, cerca de 75%.

Os preços de entrada e saída do nível curto coincidem exatamente com os do GPT-6 Luna, lançado pela OpenAI no final de setembro. Os modelos pequenos das duas empresas agora estão colados na mesma faixa de preço.

No mesmo dia, a Anthropic também reduziu o preço de leitura de cache do Sonnet 5.5 de US$ 0,20 para US$ 0,10 por milhão de tokens, e distribuiu créditos de API para assinantes: Max 5x recebe US$ 100 por mês, Max 20x recebe US$ 200, e o plano Team tem até US$ 500 no total para toda a equipe. O desenvolvedor Simon Willison escreveu em seu blog que esses créditos não acumulam para o mês seguinte se não forem usados.

Benchmarks e níveis de raciocínio

O Haiku 5.5 vem com raciocínio embutido e não pode ser desativado; é possível escolher entre cinco níveis — low, medium, high, xhigh, max —, sendo medium o padrão. Segundo números divulgados oficialmente, o modelo atingiu 72,4% no subconjunto offline do OSWorld 2.1, 39,2% no Terminal-Bench 4.0, e no Humanity's Last Exam obteve 45,9% sem ferramentas e 57,4% com ferramentas.

Alguns clientes iniciais divulgaram seus próprios números internos. A Box afirma que o novo modelo pontuou 11 pontos acima do Haiku 4.5 em seus testes, com latência cerca de metade:

"Claude Haiku 5.5 scored 11 points higher than Haiku 4.5 at about half the latency."

(O Claude Haiku 5.5 pontuou 11 pontos acima do Haiku 4.5, com latência cerca de metade.)

A Asana relatou uma queda de latência superior a 30%, e a HubSpot disse ter obtido a maior pontuação já vista nesse teste, 92,8%. Todos esses números vêm de testes próprios dos clientes, sem divulgação das perguntas usadas.

O nível de raciocínio tem grande impacto no custo. Simon Willison testou o mesmo prompt — 'desenhe um pelicano andando de bicicleta' — nos níveis mais baixo e mais alto: o nível low custou cerca de US$ 0,0009 e levou 7 segundos; o nível max custou cerca de US$ 0,034 e levou 5 minutos e 9 segundos, uma diferença de custo por execução de mais de 30 vezes.

Cálculo rápido: o tokenizador consome parte do desconto

Além da tabela de preços, há uma variável fácil de esquecer. Simon Willison aponta que o Haiku 5.5 mudou de tokenizador, e o mesmo trecho de texto agora é dividido em cerca de 1,25 vez mais tokens do que no Haiku 4.5.

Fazendo um cálculo aproximado com esse fator: o custo real de entrada no nível curto equivale a US$ 0,125 por milhão de 'tokens antigos', contra US$ 1 do Haiku 4.5, uma redução de cerca de 87%, ainda considerável. No nível longo, o quadro é menos favorável: US$ 0,50 multiplicado por 1,25 dá US$ 0,625, e a redução cai para cerca de 37%.

Somando o raciocínio ativado por padrão, os tokens de saída ficam mais numerosos do que no Haiku 4.5 sem raciocínio, variando conforme o nível e a tarefa. Para equipes com tarefas de entrada curta, como benchmarks, extração e roteamento, a troca de modelo praticamente já economiza dinheiro; já em cenários com documentos longos e contexto extenso, o ideal é testar primeiro o próprio tráfego antes de fechar a conta.

Sobre segurança, a Anthropic afirma que as restrições do Haiku 5.5 para solicitações relacionadas a segurança cibernética ficam entre as do Haiku 4.5 e do Sonnet 5.5, enquanto as proteções na área biológica são equivalentes às da série Sonnet 5; pesquisas relacionadas exigem solicitação separada de qualificação de verificação.

Fontes: página do produto Claude Haiku 5.5 da Anthropic, blog de Simon Willison, CocoLoop, SiliconANGLE; a tabela de preços da Anthropic foi verificada para os dois níveis de preço e comparada com o Haiku 4.5 nos preços de cache, e o corte no preço de leitura de cache do Sonnet 5.5 segue o anúncio oficial.