El modelo más barato de Anthropic hasta la fecha cuesta alrededor de la cuarta parte que su antecesor. Esto es lo que significa Claude Haiku 5.5 para quien paga su factura de API contando los tokens.
Claude Haiku 5.5 llega como el modelo pequeño más barato de Anthropic
Anthropic presentó Claude Haiku 5.5 el 7 de octubre y lo define como el modelo pequeño más barato, rápido y capaz que ha lanzado hasta ahora. El dato que importa a quien paga facturas de API es sencillo: según la compañía, ejecutar Haiku 5.5 cuesta alrededor de un 75% menos que Haiku 4.5 de media.
Esa es la promesa en una línea. ¿Y el panorama completo? Más interesante. Anthropic acompañó el lanzamiento con un cambio en un modelo mayor y una rebaja extra para suscriptores.
Haiku es la gama pequeña y veloz dentro de la familia Claude. Está pensada para trabajos que se repiten: resumir documentos, clasificar y etiquetar contenido, responder preguntas sobre un solo archivo y manejar consultas tipo base de datos. Puro trabajo de fondo. Si alguna vez has conectado un chatbot a un buzón de soporte o a un flujo de documentos, Haiku es el modelo que trabaja de fondo mientras otro más grande revisa los casos complicados.
Claude Haiku 5.5 conserva ese papel, pero abarata su uso a gran escala. Artificial Analysis, firma independiente de evaluación de modelos, le dio una puntuación de 43 en su índice de inteligencia. No es el techo de la tabla. Es el modelo que hace rentable el trabajo de fondo.
Qué significa ese 75% de ahorro en la factura de API
La caída de coste es la razón por la que la mayoría de los desarrolladores se fijará en este lanzamiento. Anthropic asegura que Haiku 5.5 cuesta cerca de un 75% menos de ejecutar que Haiku 4.5, lo que equivale a pagar aproximadamente un cuarto por el mismo volumen de trabajo.
¿Qué cambia para una startup que lanza millones de clasificaciones al mes? Cambia el cálculo sobre qué tareas merece la pena automatizar. Los trabajos repetitivos que antes resultaban demasiado caros para aplicarlos a cada documento encajan de repente en un presupuesto normal.
Anthropic recomienda Haiku 5.5 para trabajo de alto volumen sensible al coste, y señala que también funciona bien como subagente por debajo de Opus 5.5 y Sonnet 5.5 en tareas de programación. Hay un matiz que conviene saber: ese 75% es un promedio que da la propia compañía, y tu ahorro real depende del tipo de tarea y de la longitud de las respuestas. Anthropic no ha publicado un desglose completo del precio por token en cada gama, así que toma el promedio como guía general, no como promesa cerrada.
La rebaja en la caché de Sonnet 5.5 y los créditos mensuales
El lanzamiento no se queda en Haiku. Anthropic también recortó a la mitad el precio de lectura de caché de Sonnet 5.5, hasta los 0,10 dólares por millón de tokens. La caché sirve para no volver a cobrar el mismo contexto una y otra vez: si una aplicación reenvía instrucciones largas en cada consulta, guardarlas abarata esas repeticiones. Con la mitad de precio, los asistentes que arrastran mucho contexto fijo notan menos la factura.
A eso se suma una asignación de créditos mensuales para suscriptores que Anthropic presentó junto al modelo, un gesto que busca que quien ya paga una suscripción tenga también margen para probar la API sin que le suponga un gasto aparte.
Sin sorpresas en la factura. Ese es el objetivo.
Dónde funciona Haiku 5.5 y qué lugar ocupa en la familia Claude
Haiku 5.5 está disponible desde el primer día en la plataforma de Claude y en los tres grandes nubes: AWS, Google Cloud y Microsoft Azure. Es decir, no hay que esperar para integrarlo en una infraestructura ya montada.
El lanzamiento encaja en una secuencia que Anthropic venía preparando desde septiembre. Opus 5.5 llegó el 22 de septiembre y entonces la compañía ya adelantó que un Haiku nuevo llegaría "en las próximas semanas". Sonnet 5.5 había salido el 28 de septiembre, con una mejora de velocidad del 30%. Con Haiku 5.5, la familia Claude 5.5 ya tiene cubiertas sus tres alturas: el modelo tope, el intermedio y el pequeño.
Para el lector, la lectura práctica es esta: los modelos pequeños dejaron de ser una versión recortada con la que hay que conformarse y se han convertido en la pieza que hace viable el trabajo masivo. Si tu producto depende de clasificar, resumir o responder en volumen, este es el modelo que toca revisar primero.
Lo que queda por comprobar es si el ahorro se sostiene cuando el trabajo se complica. Los promedios de precio se calculan sobre casos típicos. Las tareas largas o con mucho razonamiento siguen consumiendo más tokens que las cortas. Merece la pena medir tu propio uso antes de dar por sentado un recorte del 75%.






