Anthropic lanzó Claude Haiku 5.5 el 7 de octubre, el primer modelo pequeño de la generación Claude 5 — el Haiku anterior se había quedado en la versión 4.5. El nuevo modelo llegó el mismo día a Claude Platform y, de forma simultánea, a AWS, Google Cloud y Microsoft Azure; Claude Code también lo incorporó en una actualización publicada ese mismo día.
El posicionamiento oficial es muy específico: tareas por lotes de alto rendimiento y el papel de subagente para modelos más grandes. El precio es el protagonista de este lanzamiento.
Dos niveles de precio, según la longitud del prompt
Haiku 5.5 divide el precio en dos niveles según la longitud de cada prompt, con 100.000 tokens como límite:
| Por millón de tokens | Haiku 5.5 (≤100k) | Haiku 5.5 (>100k) | Haiku 4.5 |
|---|---|---|---|
| Entrada | 0,10 $ | 0,50 $ | 1,00 $ |
| Salida | 0,50 $ | 2,50 $ | 5,00 $ |
| Lectura de caché | 0,01 $ | 0,05 $ | 0,10 $ |
| Escritura de caché | 0,125 $ | 0,625 $ | 1,25 $ |
En el nivel de prompt corto, todos los precios equivalen a una décima parte de los de Haiku 4.5; en el nivel largo, a la mitad. Según Anthropic, el costo operativo total cae en promedio alrededor de un 75%.
Los precios de entrada y salida del nivel corto coinciden exactamente con los de GPT-6 Luna, que OpenAI lanzó a finales de septiembre. Los modelos pequeños de ambas compañías ya están alineados en la misma línea de precios.
El mismo día, Anthropic también redujo el precio de lectura de caché de Sonnet 5.5 de 0,20 a 0,10 dólares por millón de tokens, y otorgó créditos de API a los suscriptores: Max 5x recibe 100 dólares al mes, Max 20x recibe 200 dólares, y el plan Team tiene hasta 500 dólares en total para todo el equipo. El desarrollador Simon Willison escribió en su blog que esos créditos no se acumulan para el mes siguiente si no se usan por completo.
Benchmarks y niveles de razonamiento
Haiku 5.5 viene con razonamiento integrado que no se puede desactivar; se puede elegir entre cinco niveles — low, medium, high, xhigh, max —, con medium como valor predeterminado. Según las cifras publicadas oficialmente, el modelo alcanzó 72,4% en el subconjunto offline de OSWorld 2.1, 39,2% en Terminal-Bench 4.0, y en Humanity's Last Exam obtuvo 45,9% sin herramientas y 57,4% con herramientas.
Algunos clientes tempranos han publicado sus propias cifras internas. Box afirma que el nuevo modelo obtuvo 11 puntos más que Haiku 4.5 en sus pruebas, con una latencia aproximadamente la mitad:
"Claude Haiku 5.5 scored 11 points higher than Haiku 4.5 at about half the latency."
(Claude Haiku 5.5 obtuvo 11 puntos más que Haiku 4.5, con una latencia aproximadamente la mitad.)
Asana reportó una caída de latencia superior al 30%, y HubSpot dijo haber obtenido la puntuación más alta vista en esta prueba, 92,8%. Todas estas cifras provienen de pruebas propias de los clientes, sin que se hayan publicado las preguntas utilizadas.
El nivel de razonamiento tiene un gran impacto en el costo. Simon Willison probó el mismo prompt — 'dibuja un pelícano andando en bicicleta' — en el nivel más bajo y en el más alto: el nivel low costó alrededor de 0,0009 dólares y tardó 7 segundos; el nivel max costó alrededor de 0,034 dólares y tardó 5 minutos y 9 segundos, una diferencia de costo por ejecución de más de 30 veces.
Cálculo rápido: el tokenizador se lleva parte del descuento
Más allá de la tabla de precios hay una variable fácil de pasar por alto. Simon Willison señala que Haiku 5.5 cambió de tokenizador, y el mismo fragmento de texto ahora se divide en aproximadamente 1,25 veces más tokens que en Haiku 4.5.
Haciendo un cálculo aproximado con este factor: el costo real de entrada en el nivel corto equivale a 0,125 dólares por millón de 'tokens antiguos', frente al 1 dólar de Haiku 4.5, una reducción de alrededor del 87%, aún considerable. En el nivel largo el panorama es menos favorable: 0,50 dólares multiplicado por 1,25 da 0,625 dólares, y la reducción se reduce a alrededor del 37%.
Si se suma el razonamiento activado por defecto, los tokens de salida serán más numerosos que en Haiku 4.5 sin razonamiento, y la diferencia exacta depende del nivel y la tarea. Para equipos con tareas de entrada corta, como benchmarks, extracción y enrutamiento, cambiar de modelo prácticamente ahorra dinero de forma directa; en escenarios con documentos largos y contexto extenso, lo mejor es probar primero con el tráfico propio antes de calcular la factura.
En cuanto a seguridad, Anthropic afirma que las restricciones de Haiku 5.5 para solicitudes relacionadas con ciberseguridad se ubican entre las de Haiku 4.5 y Sonnet 5.5, mientras que las protecciones en el área biológica son equivalentes a las de la serie Sonnet 5; las investigaciones relacionadas requieren solicitar por separado una calificación de verificación.
Fuentes: página de producto de Claude Haiku 5.5 de Anthropic, blog de Simon Willison, CocoLoop, SiliconANGLE; la tabla de precios de Anthropic se verificó para ambos niveles y se comparó con Haiku 4.5 en los precios de caché, y el recorte en el precio de lectura de caché de Sonnet 5.5 sigue el anuncio oficial.