Anthropic lanzó Claude Haiku 5.5 el martes y lo describió como "el modelo pequeño más barato, más rápido y más capaz que jamás hayamos lanzado". El lanzamiento viene con un fuerte recorte de precios de dos niveles que reduce los costos de entrada a $0,10 por millón de tokens para la mayoría de las solicitudes, una medida que ejerce presión directa sobre el GPT-6 Luna de OpenAI en el segmento de modelos pequeños y extiende una guerra de precios de meses en toda la industria de la IA.

El anuncio, publicado en el sitio web de Anthropic el 7 de octubre de 2026, posiciona al Haiku 5.5 como el tercer modelo de la familia Claude 5.5, junto con el Sonnet 5.5 y el Opus 5.5. Reuters caracterizó el lanzamiento como una expansión de Anthropic de su línea de modelos mientras se prepara para una oferta pública inicial planificada, y el modelo ya está disponible en GitHub Copilot, Amazon Web Services, Google Cloud y Microsoft Foundry. El lanzamiento es la última entrada en un mes de últimas noticias sobre IA en el que se han producido lanzamientos de modelos, recortes de precios y cambios de políticas casi todos los días.

Un modelo pequeño diseñado para trabajos de gran volumen

Según Anthropic, Claude Haiku 5.5 está diseñado para tareas de gran volumen y sensibles a los costos en lugar de razonamiento a nivel de frontera. La compañía dice que "maneja de manera confiable cargas de trabajo rápidas y repetitivas", como resúmenes, compactación, consultas de bases de datos y solicitudes de clasificación.

Anthropic también posiciona el nuevo modelo como compañero de sus sistemas más grandes: Haiku 5.5 "combina bien con Opus 5.5 y Sonnet 5.5 como un subagente en el trabajo de codificación", permitiendo a los desarrolladores dirigir subtareas rápidas y baratas a Haiku mientras reservan modelos más grandes para razonamientos complejos. Debido a que es el modelo más rápido de Anthropic hasta la fecha a velocidad estándar, la compañía lo recomienda para aplicaciones sensibles a la latencia, como soporte al cliente en vivo y uso del navegador. Una nota al pie añade una advertencia: los modelos Opus de Anthropic aún se ejecutan más rápido en el modo rápido.

Precio: hasta un 90% más barato que Haiku 4.5

El cambio principal es el precio. Anthropic dice que ejecutar Haiku 5.5 cuesta alrededor de un 75% menos que Haiku 4.5 en promedio, con una estructura escalonada que depende del tamaño del mensaje.

Para solicitudes con solicitudes de hasta 100.000 tokens, que según Anthropic representaron aproximadamente el 90% de las solicitudes del modelo Haiku anterior, los precios son un 90% más bajos que los de Haiku 4.5. Las solicitudes de más de 100.000 tokens cuestan un 50% menos.

La tabla de precios por millón de tokens del anuncio de Anthropic muestra la escala del recorte:

  • Tokens de entrada: $0,10 (solicitudes de hasta 100 000) o $0,50 (más de 100 000), en comparación con $1,00 fijo para Haiku 4.5
  • Fichas de salida: $0,50 o $2,50, en comparación con $5,00
  • Lecturas de caché: $0,01 o $0,05, en lugar de $0,10
  • Escrituras en caché: $0,125 o $0,625, en comparación con $1,25

En el nivel sub-100K, eso hace que el precio de salida de Haiku 5.5 sea una quinta parte de los $10.00 por millón de tokens de salida de Sonnet 5.5.

Anthropic señala un detalle técnico detrás de los números: Haiku 5.5 usa un tokenizador actualizado, similar a Sonnet 5.5 y Opus 5.5, lo que significa que usa un poco más de tokens por tarea que Haiku 4.5. La compañía dice que su cálculo de costo promedio explica esa diferencia.

Puntos de referencia: por delante de GPT-6 Luna en la mayoría de las filas

Anthropic publicó una tabla de referencia que compara Haiku 5.5 con Haiku 4.5, GPT-6 Luna y Sonnet 5.5. En la mayoría de las evaluaciones enumeradas, el nuevo modelo termina por delante del Luna y dramáticamente por delante de su predecesor:

  • GDPval-AA v2.1 (trabajo de conocimiento): 1620 para Haiku 5.5, versus 735 para Haiku 4.5, 1437 para GPT-6 Luna y 1840 para Sonnet 5.5
  • AA-Briefcase v1.1: 1578, versus 614 para Haiku 4.5 y 1336 para Luna
  • OSWorld 2.1, subconjunto fuera de línea (uso de computadora): 72,4%, versus 15,7% para Haiku 4.5, 48,9% para Luna y 83,9% para Sonnet 5.5
  • El último examen de la humanidad: 45,9% sin herramientas y 57,4% con herramientas, frente a 10,2% y 18,7% para Haiku 4.5
  • Terminal-Bench 4.0 (codificación agente): 39,2%, versus 16,4% de Luna y 70,6% de Sonnet 5.5
  • FrontierCode 1.1, Principal: 46,4%, por delante del 42,4% de Luna

El patrón es consistente: Haiku 5.5 cierra gran parte de la brecha con GPT-6 Luna y, en el uso de computadoras, lo supera por completo, mientras que el propio Sonnet 5.5 de Anthropic todavía lidera todas las categorías. La guía de Anthropic refleja esa jerarquía: la compañía dice que Sonnet 5.5 y Opus 5.5 "siguen siendo mejores opciones para tareas complejas de codificación agente como las medidas por Terminal-Bench 4.0", mientras que Haiku 5.5 apunta a trabajos de alcance limitado que "de otro modo podrían haber tenido un costo prohibitivo con versiones anteriores de Claude".

Primer Haiku con un dial de esfuerzo

Haiku 5.5 es también el primer modelo de clase Haiku que se envía con una configuración de esfuerzo ajustable, el control de costo versus inteligencia que Anthropic ofrecía anteriormente en sus modelos más grandes. Los usuarios pueden elegir cuánto cálculo consume cada solicitud y los gráficos de Anthropic muestran puntuaciones de referencia en cada nivel de esfuerzo, desde bajo hasta máximo.

Postura de seguridad: más estricta que el haiku 4.5, más flexible que el soneto

En cuanto a la seguridad, Anthropic dice que Haiku 5.5 muestra "mejoras importantes en casi todas nuestras evaluaciones de alineación en relación con Haiku 4.5", con muchos menos casos de comportamiento desalineado y una menor disposición a cooperar con el mal uso.

Las salvaguardias de ciberseguridad del modelo son más restrictivas que las del Haiku 4.5, aunque algo menos restrictivas que las de los modelos más grandes recientes de Anthropic. Permiten una gama más amplia de tareas de seguridad defensiva que las salvaguardas de Sonnet 5.5, pero aún bloquean las pruebas de penetración y las técnicas que es más probable que utilicen los atacantes. Las salvaguardas de biología coinciden con las de Sonnet 5, Sonnet 5.5 y Opus 5. Las organizaciones que necesiten un acceso más amplio pueden postularse a los programas de verificación cibernética o de ciencias biológicas de Anthropic. Los detalles completos se encuentran en la tarjeta del sistema Haiku 5.5.

El resto del anuncio: Sonnet más barato, créditos API gratuitos

El lanzamiento incluyó varios otros cambios. Las lecturas de caché en Claude Sonnet 5.5 ahora cuestan $0,10 por millón de tokens en lugar de $0,20: un recorte del 50% que, según Anthropic, hace que Sonnet 5.5 sea aproximadamente un 20% más barato en la mayoría de los trabajos de agente, ya que las lecturas de caché dominan el consumo de tokens en los flujos de trabajo de los agentes.

Anthropic también está lanzando créditos API mensuales esta semana para clientes de suscripción: $100 por mes para usuarios Max 5x, $200 para usuarios Max 20x y hasta $500 agrupados entre usuarios para planes Team, utilizables en cualquier modelo. Los créditos están dirigidos a suscriptores que crean herramientas y agentes en la Plataforma Claude.

Los desarrolladores también reciben actualizaciones de SDK: los SDK de Python y TypeScript de Anthropic ahora admiten el uso de computadoras y navegadores en versión beta, capacidades que, según la compañía, se adaptan al perfil de velocidad-precio de Haiku 5.5.

Una guerra de precios sin final a la vista

La cobertura del Decoder enmarcó el lanzamiento como prueba de que "la carrera armamentista de precios de la IA está lejos de terminar", y las cifras respaldan esa lectura. En septiembre, Anthropic y OpenAI lanzaron modelos emblemáticos rivales con pocas horas de diferencia, con recortes de precios competitivos. Haiku 5.5 extiende esa batalla al extremo inferior del mercado, donde los modelos pequeños impulsan las cargas de trabajo de mayor volumen y más sensibles al precio.

Para los desarrolladores, el efecto inmediato es sencillo: la inferencia de modelos pequeños en la plataforma Claude ahora comienza en $0,10 por millón de tokens de entrada y $0,50 por millón de tokens de salida, con GPT-6 Luna superado en la mayoría de los puntos de referencia publicados por Anthropic a ese precio. Si OpenAI responde con un recorte de precios de Luna, o espera su próximo lanzamiento de modelo pequeño, indicará cuán duradero es realmente este precio mínimo.

Haiku 5.5 ya está disponible en las aplicaciones y API propias de Anthropic, Amazon Web Services, Google Cloud y Microsoft Foundry, y ya está integrado en GitHub Copilot.

Manténgase por delante de la IA Lea más noticias sobre IA en AI Buzz Wire