Anthropic lanza Claude Haiku 5.5: su modelo pequeño más rápido cuesta alrededor de un 75 % menos
Anthropic presenta Claude Haiku 5.5, su modelo pequeño más rápido y capaz. Su coste medio de ejecución es alrededor de un 75 % menor que Haiku 4.5.
Anthropic ha lanzado Claude Haiku 5.5, la nueva versión de su modelo pequeño orientado a tareas donde importan especialmente la velocidad, el volumen y el coste. La compañía lo presenta como el Haiku más rápido y capaz que ha desarrollado hasta ahora y asegura que, de media, cuesta alrededor de un 75 % menos de ejecutar que Claude Haiku 4.5.
Ese 75 % no debe interpretarse como un descuento fijo aplicable a cualquier petición. La nueva estructura de precios depende de la longitud del prompt: Haiku 5.5 es un 90 % más barato que Haiku 4.5 para solicitudes de hasta 100.000 tokens y un 50 % más barato cuando se supera ese umbral. Anthropic calcula aproximadamente un 75 % de reducción media teniendo en cuenta el uso histórico y otros cambios técnicos del modelo.
Claude Haiku 5.5 ya está disponible
Anthropic lanzó oficialmente Claude Haiku 5.5 el 7 de octubre de 2026 y el modelo ya está disponible en sus principales plataformas.
Los usuarios de Claude pueden seleccionarlo en:
- Claude.ai;
- la aplicación para iOS;
- la aplicación para Android;
- Claude Code.
Anthropic indica que está disponible para usuarios Free, Pro, Max, Team y Enterprise.
Los desarrolladores también pueden utilizarlo mediante Claude Platform con el identificador:
claude-haiku-5-5
Además, el modelo está disponible a través de Amazon Web Services, Google Cloud y Microsoft Azure.
Cuánto cuesta Claude Haiku 5.5
Anthropic ha introducido dos niveles de precio dependiendo de la longitud del prompt.
Para solicitudes de hasta 100.000 tokens:
- Entrada: 0,10 dólares por millón de tokens.
- Salida: 0,50 dólares por millón de tokens.
- Lecturas de caché: 0,01 dólares por millón de tokens.
- Escrituras de caché: 0,125 dólares por millón de tokens.
Para prompts de más de 100.000 tokens:
- Entrada: 0,50 dólares por millón de tokens.
- Salida: 2,50 dólares por millón de tokens.
- Lecturas de caché: 0,05 dólares por millón de tokens.
- Escrituras de caché: 0,625 dólares por millón de tokens.
Por tanto, utilizar contextos muy largos continúa siendo considerablemente más caro que procesar peticiones por debajo del límite de 100.000 tokens.
De dónde sale la reducción media del 75 %
Claude Haiku 4.5 tenía un precio de 1 dólar por millón de tokens de entrada y 5 dólares por millón de tokens de salida.
En las peticiones de hasta 100.000 tokens, Haiku 5.5 reduce esas tarifas a 0,10 y 0,50 dólares respectivamente. Eso representa una rebaja del 90 %.
Para peticiones superiores a 100.000 tokens, los precios de 0,50 y 2,50 dólares suponen una reducción del 50 % frente a Haiku 4.5.
Anthropic explica que aproximadamente el 90 % de las solicitudes realizadas anteriormente a Haiku 4.5 estaban dentro del primer tramo, pero su cálculo también tiene en cuenta que Haiku 5.5 utiliza un tokenizer actualizado y puede consumir una cantidad ligeramente diferente de tokens para realizar el mismo trabajo.
Por eso la compañía resume el resultado como alrededor de un 75 % menos de coste de ejecución de media, y no como una rebaja universal del 75 % en todas las llamadas.
Anthropic dice que es su modelo más rápido hasta ahora
La compañía también presenta Haiku 5.5 como su modelo más rápido a velocidad estándar.
Existe una precisión importante: Anthropic aclara que los modelos Opus ejecutados mediante su modo Fast pueden alcanzar velocidades superiores. La comparación de Haiku 5.5 como modelo más rápido se realiza utilizando la configuración estándar de cada modelo.
La baja latencia hace que Anthropic lo oriente especialmente a experiencias donde una respuesta rápida resulta importante.
Entre los casos de uso que propone están:
- atención al cliente en tiempo real;
- chat y asistentes dentro de aplicaciones;
- agentes de voz;
- clasificación de grandes cantidades de contenido;
- resúmenes;
- enrutamiento de solicitudes;
- consultas a bases de datos;
- automatización del navegador y del escritorio.
Está pensado para ejecutar muchas tareas pequeñas
Anthropic no pretende posicionar Haiku 5.5 como sustituto directo de sus modelos mayores en cualquier escenario.
Su principal objetivo son trabajos bien definidos que necesitan ejecutarse con mucha frecuencia y donde utilizar un modelo de mayor tamaño puede resultar innecesariamente caro.
Un sistema de agentes, por ejemplo, puede utilizar un modelo grande para planificar una tarea compleja y enviar después subtareas específicas a varios Haiku 5.5.
Anthropic menciona como ejemplos buscar datos concretos, resumir documentos, clasificar información o realizar cambios de código muy delimitados.
Es el primer Haiku con control de esfuerzo
Claude Haiku 5.5 introduce además una característica que hasta ahora no estaba disponible en esta familia: un ajuste configurable de esfuerzo.
Los desarrolladores pueden modificar cuánto procesamiento dedica el modelo a una tarea para buscar un equilibrio diferente entre:
- coste;
- velocidad;
- capacidad de razonamiento.
Esto permite utilizar una configuración económica para tareas muy sencillas y aumentar el esfuerzo cuando una solicitud necesita mayor capacidad sin cambiar necesariamente a otro modelo.
Las pruebas de Anthropic muestran un salto grande frente a Haiku 4.5
Anthropic publica varias evaluaciones internas y de terceros donde Haiku 5.5 supera ampliamente a su predecesor.
En OSWorld 2.1, una prueba orientada al uso de ordenadores por agentes, Haiku 5.5 alcanza un 72,4 % en el subconjunto utilizado por Anthropic, frente al 15,7 % de Haiku 4.5.
En Terminal-Bench 4.0, centrado en tareas de programación agéntica mediante terminal, obtiene un 39,2 %, mientras que Haiku 4.5 registra un 0 % bajo la metodología publicada.
En Humanity’s Last Exam sin herramientas, Haiku 5.5 obtiene un 45,9 %, frente al 10,2 % de la generación anterior.
Estas cifras proceden de las evaluaciones publicadas junto al lanzamiento y no significan que Haiku 5.5 sea cuatro veces mejor en cualquier trabajo real. Cada benchmark mide capacidades concretas bajo unas condiciones determinadas.
Sonnet y Opus siguen reservados para tareas más complejas
El aumento de capacidad de Haiku no elimina las diferencias dentro de la gama Claude.
Anthropic continúa recomendando Sonnet 5.5 y Opus 5.5 para trabajos de mayor complejidad, especialmente programación agéntica avanzada y tareas que requieren más razonamiento o juicio.
Haiku está pensado para complementar a esos modelos mediante subtareas rápidas y económicas. Anthropic ya había renovado la parte superior de la familia con Claude Opus 5.5, su modelo orientado a los trabajos más exigentes.
En Terminal-Bench 4.0, por ejemplo, Sonnet 5.5 obtiene un 70,6 % frente al 39,2 % de Haiku 5.5, lo que ilustra la diferencia de posicionamiento entre ambos.
Haiku 5.5 también está pensado para usar ordenadores y navegadores
Anthropic destaca especialmente el uso del nuevo modelo para automatización.
Haiku 5.5 puede utilizarse como agente para tareas repetitivas como:
- rellenar formularios;
- introducir datos;
- mover información entre aplicaciones;
- realizar operaciones repetitivas en un navegador;
- ejecutar flujos de trabajo mediante herramientas.
La empresa está actualizando además sus SDK de Python y TypeScript para añadir soporte en beta para computer use y browser use.
También cambia el precio de Claude Sonnet 5.5
El lanzamiento de Haiku llega acompañado de otra reducción de costes dentro de la familia Claude.
Anthropic ha reducido a la mitad el precio de las lecturas de caché de Claude Sonnet 5.5, desde 0,20 hasta 0,10 dólares por millón de tokens.
La compañía estima que esta modificación reduce aproximadamente un 20 % el coste de Sonnet 5.5 en la mayoría de los trabajos agénticos, debido al peso que tienen las lecturas de caché en este tipo de flujos.
Los planes Max y Team recibirán créditos mensuales para la API
Anthropic también ha anunciado nuevos créditos mensuales destinados a experimentar con Claude Platform.
- Max 5x: 100 dólares al mes.
- Max 20x: 200 dólares al mes.
- Team: hasta 500 dólares mensuales compartidos entre los usuarios.
Estos créditos podrán utilizarse con cualquiera de los modelos disponibles en Claude Platform y están destinados a desarrollar aplicaciones, herramientas y agentes mediante la API.
Haiku 5.5 completa la nueva familia Claude 5.5
Anthropic sitúa ahora a Haiku 5.5 como la alternativa de la familia para cargas masivas y sensibles al coste. Sonnet 5.5 ocupa una posición intermedia para tareas bien definidas que necesitan más capacidad, mientras Opus 5.5 queda destinado a trabajos particularmente complejos.
El principal cambio de Haiku 5.5 no es únicamente que sea más rápido. Con precios desde 0,10 dólares por millón de tokens de entrada para prompts de hasta 100.000 tokens, la compañía intenta hacer viable utilizar Claude en tareas que pueden ejecutarse millones de veces y donde el coste por llamada resulta determinante.
La cifra de aproximadamente un 75 % menos resume el coste medio que Anthropic calcula frente a Haiku 4.5. La reducción real para cada desarrollador dependerá de la longitud de los prompts, la cantidad de tokens generados, el uso de caché y el tipo concreto de carga de trabajo.