Anthropic presentó Claude Haiku 5.5 el 7 de octubre de 2026. Los tokens de entrada cuestan 0,10 $ por millón para prompts de hasta 100.000 tokens y 0,50 $ para los más largos. La empresa posiciona el modelo para tareas a gran escala y el trabajo de agentes de IA; el coste de cada solicitud depende de su longitud y del número de tokens procesados.

Un modelo para tareas frecuentes y acotadas
En el anuncio del 7 de octubre, Anthropic enumera la sumarización, la compresión de contexto (compaction), la clasificación y las consultas a bases de datos. Haiku 5.5 también se ofrece como subagente para pasos concretos del trabajo de programación; la documentación menciona además la atención al cliente y las tareas en el navegador. El ID del modelo en Claude Platform es claude-haiku-5-5.
Anthropic describe Haiku 5.5 como su modelo más rápido al comparar los modos de velocidad estándar; Opus en Fast Mode funciona más rápido. El primer modelo de la familia Haiku con effort ajustable permite elegir una configuración que priorice el coste o la calidad del razonamiento. La redacción no realizó pruebas independientes, por lo que las estimaciones de velocidad y calidad siguen siendo afirmaciones de la empresa.
Cuánto cuestan los tokens
Las tarifas de Claude Platform se indican por millón de tokens. El umbral depende de la longitud del prompt:
| Concepto | Hasta 100.000 tokens | Más de 100.000 | Haiku 4.5 |
|---|---|---|---|
| Tokens de entrada | 0,10 $ | 0,50 $ | 1 $ |
| Tokens de salida | 0,50 $ | 2,50 $ | 5 $ |
| Lectura de caché | 0,01 $ | 0,05 $ | 0,10 $ |
| Escritura en caché durante 5 minutos | 0,125 $ | 0,625 $ | 1,25 $ |
Frente a Haiku 4.5, los precios por token son un 90 % más bajos para prompts de hasta 100.000 tokens y un 50 % más bajos por encima del umbral. Por separado, Anthropic estima que el coste medio de completar una tarea es aproximadamente un 75 % menor. Esta estimación de la empresa tiene en cuenta la distribución de las solicitudes y un tokenizador actualizado, que utiliza algo más de tokens para la misma tarea. Por tanto, el ahorro medio estimado no garantiza el mismo ahorro en cada solicitud.

Límites de la recomendación y cambios relacionados
Para la programación compleja con agentes, Anthropic recomienda los modelos superiores Sonnet 5.5 u Opus 5.5, y reserva Haiku 5.5 para etapas más acotadas, como la sumarización y el trabajo de subagentes. Esta elección distribuye el coste según el tipo de trabajo: las operaciones breves y frecuentes pueden asignarse al modelo más pequeño, mientras que las tareas complejas se dejan a los modelos superiores.
Desde el 7 de octubre, según la misma publicación, la lectura de caché de Sonnet 5.5 bajó de 0,20 $ a 0,10 $ por millón de tokens. Anthropic relaciona el cambio con una reducción aproximada del 20 % en el coste de la mayoría de las tareas con agentes. La empresa también anunció que Haiku 5.5 está disponible en Claude Platform, AWS, Google Cloud y Azure; la redacción no comprobó por separado su disponibilidad en cada plataforma de terceros.
Anthropic prometió empezar a implementar créditos mensuales de API para suscriptores Max y Team durante la semana del 7 de octubre. A fecha de la comprobación, el 8 de octubre, no se ha confirmado que la implementación haya concluido. Para los equipos, la conclusión práctica del lanzamiento es comparar primero la longitud de los prompts con el umbral de 100.000 tokens y, después, probar el modelo adecuado con sus propias tareas y costes.