⏱️ Lectura: 10 min
Anthropic bajó el precio de su modelo más chico un 75% en promedio y, a la vez, lo convirtió en el más rápido que la compañía ofrece hasta octubre de 2026. Claude Haiku 5.5 salió este 7 de octubre como reemplazo directo de Haiku 4.5, con una ventaja adicional: por primera vez, un modelo de la línea Haiku permite ajustar cuánto esfuerzo de razonamiento usa en cada tarea.
📑 En este artículo
El lanzamiento llega acompañado de otros dos cambios de precio: la lectura de caché de Claude Sonnet 5.5 cuesta ahora la mitad, y los suscriptores de Claude Max y Team reciben un crédito mensual nuevo para construir agentes sobre la Claude Platform.
TL;DR
- Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026 con un costo promedio 75% menor al de Haiku 4.5.
- El nuevo modelo suma un ajuste de esfuerzo configurable (Low a Max), antes exclusivo de Opus y Sonnet.
- La lectura de caché de Sonnet 5.5 bajó a la mitad: el trabajo agéntico ahora cuesta cerca de 20% menos.
- Haiku 5.5 anota 72,4% en OSWorld 2.1 frente al 15,7% de Haiku 4.5, según el benchmark de uso de computadora.
- Claude Max y Team suman un crédito mensual de API para construir agentes nuevos sobre la plataforma.
Qué es Claude Haiku 5.5
Claude Haiku 5.5 es el modelo más pequeño y económico de la familia Claude 5.5 de Anthropic, pensado para tareas de alto volumen como resúmenes, clasificación y consultas a bases de datos. También funciona como subagente de código junto a Opus 5.5 y Sonnet 5.5.
Según el anuncio oficial de Anthropic, el modelo está optimizado para trabajos sensibles a la velocidad, como soporte al cliente en vivo y uso de navegador, y es el modelo más rápido que la compañía publicó hasta la fecha.
Qué pasó
El 7 de octubre de 2026, Anthropic publicó Claude Haiku 5.5 como sucesor de Haiku 4.5. La compañía lo describe como the cheapest, fastest, and most capable small model we’ve ever released en su página de lanzamiento. El modelo ya está disponible en la Claude Platform, con un costo promedio 75% menor al de su predecesor.
Junto con el modelo, Anthropic anunció dos cambios de precio adicionales. Primero, la lectura de caché de Claude Sonnet 5.5 bajó a la mitad, lo que deja ese modelo cerca de 20% más barato en la mayoría del trabajo agéntico. Segundo, los suscriptores de Claude Max y Team reciben un crédito mensual nuevo en la API, pensado para que construyan agentes y aplicaciones propias sobre la plataforma.
Haiku 5.5 incorpora además una novedad que antes era exclusiva de los modelos grandes: un ajuste de esfuerzo configurable. El usuario puede elegir entre los niveles Low, Med, High, Xhigh y Max según si prioriza el costo o la precisión de cada respuesta, la misma lógica que ya usan Opus 5.5 y Sonnet 5.5.
Contexto e historia
La línea Haiku es la más chica de la familia Claude desde su primera versión. Mientras Opus apunta a razonamiento profundo y Sonnet busca el punto medio entre costo y capacidad, Haiku siempre se vendió como la opción para volumen: miles de llamadas por minuto a precios bajos. Haiku 4.5, su antecesor inmediato, ya ocupaba ese lugar en productos con alto tráfico, pero quedaba lejos de los modelos grandes en tareas que requerían varios pasos de razonamiento o manejo de herramientas.
Ese salto de capacidad es lo que cambia con Haiku 5.5. En Terminal-Bench 4.0, que mide programación agéntica en una terminal real, Haiku 4.5 anotaba 0,0%. Haiku 5.5 llega a 39,2%, todavía lejos del 70,6% de Sonnet 5.5, pero ya en un rango donde el modelo chico puede resolver tareas completas, no solo fragmentos de código.
El contexto de mercado también importa. Clientes como Asana, HubSpot, AlphaSense y Box ya probaron Haiku 5.5 antes del lanzamiento, y sus resultados aparecen citados en el propio anuncio. Esa validación temprana con clientes empresariales es una práctica habitual en los lanzamientos recientes de Anthropic, que busca mostrar impacto medible antes de abrir el modelo al público general.
Detalles técnicos: cómo funciona el ajuste de esfuerzo
El punto técnico central del lanzamiento no es el modelo en sí, sino el control de esfuerzo que ahora comparte toda la familia Claude 5.5. En la práctica, el parámetro de esfuerzo decide cuántos tokens de razonamiento interno genera el modelo antes de responder: en Low, Haiku 5.5 prioriza velocidad y gasta pocos tokens de pensamiento; en Max, el modelo invierte más cómputo por respuesta y se acerca a la precisión de un modelo más grande, a costa de latencia y precio. Es, además, el primer modelo de la línea Haiku con esta opción: ni Haiku 4.5 ni ningún Haiku anterior permitían elegir cuánto razonar antes de responder.
Ese mecanismo explica por qué Haiku 5.5 anota 45,9% en Humanity’s Last Exam sin herramientas y, en el mismo benchmark, se acerca más a Sonnet 5.5 (56,9%) cuando se le da más esfuerzo: no es que el modelo sepa más en Max, dedica más pasos de razonamiento a verificar su propia respuesta antes de entregarla. El costo no es gratis: según los gráficos de precisión contra costo publicados por Anthropic, pasar de Low a Xhigh en OSWorld 2.1 multiplica el gasto por tarea varias veces para ganar unos puntos porcentuales de precisión, así que conviene reservar los niveles altos para tareas donde el error sale caro.
GDPval-AA v2.1, diseñado por Artificial Analysis, evalúa agentes en trabajo profesional real de 44 ocupaciones distintas, y es otro de los benchmarks donde se ve la distancia entre modelos:
| Benchmark | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 (referencia) |
|---|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 (Elo) | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1 (offline, uso de PC) | 72,4% | 15,7% | 48,9% | 83,9% |
| Humanity’s Last Exam (sin herramientas) | 45,9% | 10,2% | , | 56,9% |
| Terminal-Bench 4.0 (coding agéntico) | 39,2% | 0,0% | 16,4% | 70,6% |
Los números vienen del propio system card de Haiku 5.5 publicado por Anthropic. GPT-6 Luna aparece como referencia externa; Sonnet 5.5 se incluye no porque compita por el mismo precio, sino para mostrar cuánta distancia de capacidad quedó entre el modelo chico y el mediano de la misma compañía.
flowchart LR
A["Tarea de entrada"] --> B{"Nivel de esfuerzo"}
B -->|"Low"| C["Respuesta rapida, costo minimo"]
B -->|"Med"| D["Balance costo y precision"]
B -->|"High"| E["Mas tokens de razonamiento interno"]
B -->|"Xhigh o Max"| F["Maxima precision, mayor costo por tarea"]
El diagrama resume la idea: el esfuerzo no cambia el modelo, cambia cuánto piensa antes de responder.
Impacto y análisis
El impacto más inmediato es económico: si una empresa ya corría millones de llamadas diarias con Haiku 4.5 para clasificación o resúmenes, el mismo volumen cuesta ahora una fracción del gasto anterior. AlphaSense reportó que su producto Ask in Document, que procesa unos 8 millones de consultas por semana, pasó de un puntaje de 0,76 a 0,84 con Haiku 5.5 en una prueba de 400 consultas, una mejora que la compañía calificó de estadísticamente significativa.
Box, por su parte, midió un puntaje 11 puntos más alto que Haiku 4.5 con la mitad de la latencia, y lo destinó a trabajo analítico a escala como reportes de costos y resúmenes financieros. Asana reportó más de 30% de reducción de latencia y hasta 2,5 veces más velocidad de inferencia por turno de agente en su suite de evaluación para AI Teammates. HubSpot, que evalúa modelos chicos sobre tareas de CRM simuladas, dijo que Haiku 5.5 obtuvo el mejor puntaje que vio en esa prueba hasta ahora: 92,8% promediado en tres corridas.
💭 Clave: Anthropic no mejoró Haiku vendiendo más inteligencia a igual precio: vendió casi la misma inteligencia a una fracción del precio, y reservó la ganancia de capacidad para quien pague por más esfuerzo.
Lo que estas cifras muestran en conjunto es un cambio de estrategia más que un salto puntual: Anthropic está empujando a Claude Haiku 5.5 hacia tareas que antes necesitaban un modelo mediano, y lo hace abaratando el modelo chico en lugar de encarecer el grande. Eso presiona a competidores a responder con sus propios modelos económicos, en una categoría donde el margen se decide por centavos por millón de tokens, no por benchmarks de frontera.
Qué sigue
Anthropic no dio fecha para la próxima actualización de la línea Haiku, pero el patrón de los últimos lanzamientos sugiere ciclos cortos: Haiku 4.5 llegó antes, y ahora Haiku 5.5 ya extiende el ajuste de esfuerzo a todo el catálogo. Lo más probable es que la próxima generación de Sonnet y Opus hereden mejoras similares de eficiencia antes de que Haiku vuelva a actualizarse.
Para desarrolladores, el cambio práctico a vigilar es el crédito mensual de API para suscriptores de Claude Max y Team: si ese crédito alcanza para correr proyectos reales de agentes sin pagar aparte, cambia el cálculo de qué plan conviene para equipos chicos que hoy pagan la API por separado de su suscripción. Anthropic no publicó el monto exacto del crédito en el anuncio, así que ese dato habrá que confirmarlo cuando la facturación lo refleje.
📖 Resumen en Telegram: Ver resumen
Probalo vos: entrá a la consola de Anthropic y corré una misma tarea de clasificación con Haiku 4.5 y Haiku 5.5 para comparar el costo y la latencia con tus propios datos.
Preguntas frecuentes
¿Qué es Claude Haiku 5.5 y en qué se diferencia de Haiku 4.5?
Claude Haiku 5.5 es la versión más reciente del modelo chico de Anthropic, con un costo promedio 75% menor y mejoras de velocidad y precisión frente a Haiku 4.5, según los benchmarks publicados por la compañía el 7 de octubre de 2026.
¿Cómo funciona el ajuste de esfuerzo de Haiku 5.5?
El ajuste de esfuerzo deja elegir entre los niveles Low, Med, High, Xhigh y Max. Cuanto más alto el nivel, más tokens de razonamiento interno usa el modelo antes de responder, lo que sube la precisión y también el costo y la latencia por tarea.
¿Haiku 5.5 reemplaza a Sonnet 5.5 o a Opus 5.5?
No. Anthropic lo posiciona como subagente junto a Opus 5.5 y Sonnet 5.5 para tareas de alto volumen, no como sustituto en trabajos que requieren el razonamiento más profundo de los modelos grandes.
¿Cuánto más barato es el modelo liviano de la familia Claude frente a su versión anterior?
Anthropic reporta un costo promedio 75% menor al de Haiku 4.5, aunque el ahorro final depende del nivel de esfuerzo elegido y del volumen de tokens de cada tarea.
¿Qué cambia en el precio de Claude Sonnet 5.5?
La lectura de caché de Sonnet 5.5 bajó a la mitad, lo que deja ese modelo cerca de 20% más barato en la mayoría del trabajo agéntico, según el mismo anuncio.
Referencias
- Anthropic: Introducing Claude Haiku 5.5: anuncio oficial con precios, benchmarks y citas de clientes.
- Anthropic: página oficial de precios: tabla de costos vigente para la familia Claude 5.5.
- Artificial Analysis: creador del benchmark GDPval-AA v2.1 citado en el anuncio.
- Wikipedia: Anthropic: contexto sobre la compañía y su familia de modelos Claude.
📱 ¿Te gusta este contenido? Únete a nuestro canal de Telegram @programacion donde publicamos a diario lo más relevante de tecnología, IA y desarrollo. Resúmenes rápidos, contenido fresco todos los días.
Imagen destacada: Foto de Igor Omilaev en Unsplash
¿Te sirvió? ¿Te dio otro error? Contalo abajo: las preguntas se responden y le sirven al siguiente que llegue.
Dejar un comentario
0 Comentarios