Anthropic lanza Opus 4.5, el primer modelo de razonamiento híbrido

Opus 4.5 es una versión importante que Anthropic lanzó a finales de 2025, y es su primer modelo de razonamiento híbrido — un modelo que integra modos de respuesta rápida y pensamiento profundo simultáneamente.

Nivel de rendimiento

En SWE-bench Verified obtuvo un 80,9 %, ocupando el primer lugar mundial en el momento de su lanzamiento. También lidera o iguala en varios otros benchmarks fuera de la programación.

La mejora más notable de Opus 4.5 se encuentra en el rendimiento en tareas complejas y de múltiples pasos. Por ejemplo, cuando se necesita comprender varios módulos de un proyecto grande y luego realizar modificaciones entre archivos — trabajos que requieren una "visión global" — la calidad de finalización de Opus 4.5 ha mejorado significativamente en comparación con la generación anterior.

Posicionamiento

En la línea de productos Claude:

  • Haiku: Rápido y económico, adecuado para tareas simples de alta frecuencia
  • Sonnet: La mejor relación costo-rendimiento
  • Opus: El techo de capacidad más alto, adecuado para tareas de alta dificultad

Después de Opus 4.5, Anthropic rápidamente iteró a la versión 4.6 (añadiendo razonamiento adaptativo y compresión de contexto). La velocidad de iteración de Anthropic en la serie Opus se ha acelerado notablemente — de una versión grande por año a una cada pocos meses.

Comentarios del mercado

Las evaluaciones de la comunidad de desarrolladores se centran en dos puntos principales:

  1. La capacidad de programación es realmente sólida, especialmente la tasa de finalización de tareas de múltiples pasos en escenarios de agente
  2. Costos elevados, los precios de llamada a la API se encuentran en el grupo más caro entre todos los modelos de vanguardia

Para desarrolladores individuales, el uso diario de Sonnet es suficiente. Opus solo vale la pena invocarlo en tareas críticas y escenarios de alto valor.

Fuente de referencia: CocoLoop, comunicado oficial de Anthropic