A Anthropic lançou em 22 de setembro o Claude Opus 5.5, o primeiro modelo da série Claude 5.5. O posicionamento oficial resume-se em duas frases: o desempenho na maioria das tarefas é equivalente ao do Claude Fable 5.1, e o custo operacional total é 40% menor que o do Opus 5.
Olhando a tabela de preços item a item, a entrada custa 4 dólares por milhão de tokens e a saída 20 dólares, ambos com queda de 20%; a leitura de cache cai de 0,50 para 0,20 dólar, uma redução de 60%. Quanto à velocidade de saída, a Anthropic afirma que é mais de 30% superior à do Opus 5, havendo ainda um modo fast a 8 e 40 dólares, com velocidade até 2,5 vezes maior. O modelo está disponível na API da plataforma Claude (com o ID claude-opus-5-5), na AWS, no Google Cloud e no Microsoft Azure, além de estar simultaneamente disponível nas plataformas de consumo; a saída máxima por chamada é de 128 mil tokens.
Resultados de benchmarks
A página oficial de lançamento traz a seguinte comparação.
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 55.8% | 52.3% |
| FrontierCode v1.1 | 54.4% | 50.3% | 48.0% |
| CursorBench 4.0 | 57.8% | 51.8% | 46.6% |
| GDPval-AA v2.1 | 1846 Elo | 1735 | 1708 |
| OSWorld 2.0 | 81.8% | 80.7% | 74.0% |
A Artificial Analysis, empresa independente de avaliação, coloca o Opus 5.5 em primeiro lugar em seu índice de inteligência, com pontuação de 58. No mesmo dia, foi lançada a versão 2.1.280 do Claude Code, que já define o Opus 5.5 como o modelo Opus padrão.
A página de lançamento também cita comentários de alguns clientes que testaram o modelo: o GitHub afirma que, para resolver as mesmas tarefas de terminal, o número de passos é menos da metade do exigido pelo Opus 5; a Optiver diz que a qualidade é comparável à do Opus 5, com cerca de metade das rodadas e custo 40% a 50% menor; a Deloitte relata que, no nível de raciocínio mais baixo, o modelo identifica 72% dos defeitos conhecidos, contra 56% do Opus 5 no nível mais alto. Todos esses números vêm de declarações de clientes reproduzidas pelo próprio fabricante na página de lançamento, sem verificação independente de terceiros.
O que a Anthropic diz sobre segurança
A Anthropic afirma que o Opus 5.5 passou por uma auditoria automatizada de comportamento, com a pontuação de alinhamento mais alta já registrada, e que as tentativas de burlar os limites do sandbox caíram 85% em relação ao Opus 5. A maior parte das tarefas de cibersegurança continua sendo direcionada ao Opus 4.8, e o nível de proteção na área biológica permanece igual ao do Claude Fable 5.1. O modelo mantém as proteções contra destilação do processo de raciocínio, recebe marca d'água conforme a Lei de IA da UE, e as empresas podem optar por retenção zero de dados. Antes do lançamento, a METR e a Frontier Design participaram da avaliação.
Taxas específicas de falha, de recusa e os itens de red-team só poderão ser conferidos quando o system card completo for divulgado; a própria página oficial não lista esses números.
Na mesma tabela de preços do dia
Também em 22 de setembro, a OpenAI lançou o GPT-6 Sol e o Luna, com preços de API reduzidos à metade em relação à geração anterior: o Sol custa 2 e 10 dólares, e o Luna, 0,10 e 0,50 dólar. Em comparação direta, o preço unitário do Opus 5.5 ainda é o dobro do Sol; o que a Anthropic vende nessa mesma faixa é pontuação e menos passos: segundo a Optiver e o GitHub, com a queda no número de rodadas por tarefa, a diferença de preço unitário é parcialmente compensada na fatura. Quanto dessa diferença é compensada depende do formato específico da tarefa, sem resposta universal.
Do lado dos desenvolvedores, já surgiu um teste com resultado contrário. O blogueiro de tecnologia Simon Willison testou pedir ao Opus 5.5, no nível de raciocínio mais alto, para gerar um SVG complexo, e o modelo consumiu todos os 128 mil tokens de saída sem concluir a tarefa. Um nível de raciocínio alto combinado com saída longa consome facilmente todo o orçamento de saída; antes de integrar o modelo a um fluxo automatizado, esse limite precisa ser considerado.
Para equipes que já usam o Opus 5, o custo de migração está concentrado principalmente em dois pontos: é preciso alterar o ID do modelo, e as mudanças na velocidade de saída e no número de rodadas fazem com que os parâmetros de timeout e retry existentes deixem de ser adequados. A redução de preço é mais perceptível em cenários de chamadas de alta frequência, especialmente com os 60% de desconto na leitura de cache — quanto mais longo o system prompt fixo e mais densas as requisições, maior a proporção economizada.
Fontes: página oficial de lançamento da Anthropic, Artificial Analysis, CocoLoop, blog de Simon Willison; a página oficial de lançamento serve de referência para os preços de cada nível, os benchmarks e as medidas de segurança.