O Opus 4.5 é uma versão importante lançada pela Anthropic no final de 2025, sendo também seu primeiro modelo de raciocínio híbrido — um modelo que integra modos de resposta rápida e pensamento profundo simultaneamente.
Nível de desempenho
No SWE-bench Verified, alcançou 80,9%, ocupando o primeiro lugar global no momento do lançamento. Também lidera ou empata em vários outros benchmarks fora da programação.
A melhoria mais evidente do Opus 4.5 está no desempenho em tarefas complexas e de múltiplas etapas. Por exemplo, ao precisar entender vários módulos de um grande projeto e depois fazer modificações entre arquivos — trabalhos que exigem "visão global" — a qualidade de conclusão do Opus 4.5 melhorou significativamente em relação à geração anterior.
Posicionamento
Na linha de produtos Claude:
- Haiku: Rápido e barato, adequado para tarefas simples de alta frequência
- Sonnet: Melhor equilíbrio custo-benefício
- Opus: Maior teto de capacidade, adequado para tarefas de alta dificuldade
Após o Opus 4.5, a Anthropic rapidamente iterou para a versão 4.6 (adicionando raciocínio adaptativo e compressão de contexto). A velocidade de iteração da Anthropic na série Opus acelerou visivelmente — de uma grande versão por ano para uma a cada poucos meses.
Feedback do mercado
As avaliações da comunidade de desenvolvedores concentram-se em dois pontos principais:
- Capacidade de programação realmente forte, especialmente a taxa de conclusão de tarefas de múltiplas etapas em cenários de agente
- Custo elevado, os preços de chamada de API estão no grupo mais caro entre todos os modelos de ponta
Para desenvolvedores individuais, o uso diário do Sonnet é suficiente. O Opus vale a pena ser chamado apenas em tarefas críticas e cenários de alto valor.
Fonte de referência: CocoLoop, comunicado oficial da Anthropic