The Decoder

Claude Haiku 5.5 llega con enormes recortes de precios que demuestran que la carrera armamentística de precios de la IA está lejos de…

El nuevo Claude Haiku 5.5 de Anthropic' aplasta a su predecesor en los benchmarks, pasando de 15.7 a 72.4 por ciento en la prueba de uso de computadora OSWorld. Los precios de los tokens caen hasta en un 90 por ciento…

Matthias Bastian
Fuente de la imagen · The Decoder

Claude Haiku 5.5 llega con enormes recortes de precios que demuestran que la carrera armamentística de precios de la IA está lejos de terminar

Matthias Bastian Matthias Bastian Ver el perfil de LinkedIn de Matthias Bastian 7 de octubre de 2026 Image description Nano Banana Pro, con indicaciones de THE DECODER

Puntos clave

  • Anthropic ha lanzado Claude Haiku 5.5, su modelo pequeño más rápido y asequible, creado para tareas de alto volumen como consultas de datos y atención al cliente.
  • Haiku 5.5 muestra grandes mejoras en benchmarks frente a Haiku 4.5 con precios de tokens hasta un 90 por ciento más bajos. También supera al modelo económico de OpenAI, GPT-6 Luna, en áreas como la codificación agéntica.
  • Haiku 5.5 ya está disponible en AWS, Google Cloud y Azure. Anthropic también está reduciendo a la mitad los costos de lectura de caché de Sonnet 5.5 e implementando créditos mensuales de API para los suscriptores.

Anthropic ha lanzado Claude Haiku 5.5, el modelo pequeño más rápido y asequible de la empresa hasta la fecha. Los resultados de los benchmarks muestran un gran salto de rendimiento respecto a su predecesor, y Anthropic también está reduciendo los precios de Sonnet 5.5.

Según Anthropic, Haiku 5.5 está diseñado para tareas de alto volumen y sensibles al costo, como resúmenes, consultas a bases de datos, clasificación y atención al cliente en vivo. En promedio, el modelo cuesta aproximadamente un 75 por ciento menos que Haiku 4.5. Para solicitudes con indicaciones de hasta 100,000 tokens, que según Anthropic representan aproximadamente el 90 por ciento de todas las solicitudes anteriores de Haiku, los precios caen hasta un 90 por ciento. Las indicaciones de más de 100,000 tokens cuestan cinco veces más.

Precio por 1 millón de tokens Haiku 5.5 (indicaciones de hasta / más de 100k) Haiku 4.5 Sonnet 5.5
Lecturas de caché $0.01 / $0.05 $0.10 $0.10
Escrituras de caché $0.125 / $0.625 $1.25 $2.50
Tokens de entrada $0.10 / $0.50 $1.00 $2.00
Tokens de salida $0.50 / $2.50 $5.00 $10.00

Anthropic señala que Haiku 5.5 utiliza un tokenizador actualizado que consume ligeramente más tokens por tarea que su predecesor. Lo mismo ocurrió con los modelos Opus 4.x, donde el uso de tokens aumentó alrededor de un 30 por ciento solo por el cambio de tokenizador. Los ahorros reales probablemente sean menores de lo que sugieren los precios por token.

Los benchmarks muestran un gran salto frente a Haiku 4.5

Haiku 5.5 obtiene 1,620 puntos en el benchmark de conocimiento GDPval-AA v2.1, más del doble que los 735 que logró su predecesor. En Humanity's Last Exam, alcanza el 45.9 por ciento sin herramientas y el 57.4 por ciento con herramientas, frente al 10.2 y el 18.7 por ciento.Anuncio

El mayor salto se produce en el uso de computadora, donde el modelo opera una computadora por sí solo. Dado que el uso de computadora consume grandes cantidades de tokens, un modelo barato y rápido como Haiku 5.5 es una opción natural. Obtiene el 72.4 por ciento en OSWorld-2.1, frente al 15.7 por ciento anterior. En el benchmark de codificación agéntica Terminal-Bench 4.0, alcanza el 39.2 por ciento, mientras que Haiku 4.5 obtuvo cero.

Anthropic también incluye el modelo económico de OpenAI GPT-6 Luna como comparación, y Haiku 5.5 lidera en todas las categorías probadas. Sin embargo, las puntuaciones de referencia de Sonnet 5.5 muestran que Haiku 5.5 todavía queda muy por detrás del modelo más grande de Anthropic.

Haiku 5.5 Haiku 4.5 GPT-6 Luna Sonnet 5.5
Trabajo de conocimiento / GDPval-AA v2.1 1,620 735 1,437 1,840
Trabajo de conocimiento / AA-Briefcase v1.1 1,578 614 1,336 1824
Uso de computadora / OSWorld 2.1 72.4% (subconjunto sin conexión) 15.7% (subconjunto offline) 48.9% (subconjunto offline) 83.9% (subconjunto offline)
Razonamiento multidisciplinario / Last Exam de la humanidad 45.9% (sin herramientas) 10.2% (sin herramientas) — 56.9% (sin herramientas)
57.4% (con herramientas) 18.7% (con herramientas) — 64.5% (con herramientas)
Codificación agéntica / Terminal-Bench 4.0 39.2% 0.0% 16.4% 70.6%
Codificación agéntica / FrontierCode 1.1 (Main) 46.4% — 42.4% 52.1% (Xhigh)
Razonamiento visual / Chartography 46.4% (sin herramientas) 6.4% (sin herramientas) 29.1% (sin herramientas) 61.6% (sin herramientas)

El primer modelo Haiku permite a los usuarios intercambiar costo por rendimiento

Haiku 5.5 es el primer modelo de clase Haiku con niveles de razonamiento ajustables, lo que permite a los usuarios equilibrar el costo frente a la calidad. Anthropic dice que el modelo funciona mejor para tareas de alcance limitado como compactación, resumen o trabajo de sub-agentes. Para codificación agéntica compleja, Sonnet 5.5 y Opus 5.5 siguen siendo las mejores opciones.

Las salvaguardas de ciberseguridad son más estrictas que en el predecesor, pero permiten una gama más amplia de tareas defensivas que Sonnet 5.5, en parte porque el modelo es menos capaz en general. Las pruebas de penetración siguen bloqueadas. Las organizaciones con necesidades más amplias pueden solicitar los programas de verificación de Anthropic para ciencias de la vida y ciberseguridad.Anuncio

Haiku 5.5 ya está disponible en todas las plataformas, incluidas Amazon Web Services, Google Cloud y Microsoft Azure.

Sonnet 5.5 también se abarata, y Anthropic reparte créditos de API

Junto con el lanzamiento de Haiku, Anthropic está reduciendo los costos de lectura de caché de Sonnet 5.5 en 50 por ciento, de $0.20 a $0.10 por millón de tokens. La empresa dice que esto debería reducir los costos de la mayoría de las tareas agénticas en alrededor de 20 por ciento. La medida es casi con certeza una reacción a la nueva serie GPT-6.1 de OpenAI, lo que demuestra que las guerras de precios de la IA se libran con más dureza que nunca.

Anthropic también está lanzando créditos mensuales de API. Los suscriptores Max-5x reciben $100, los suscriptores Max-20x reciben $200, y los suscriptores Team reciben hasta $500 al mes. Los usuarios pueden gastar los créditos para experimentar con herramientas, aplicaciones y agentes a través de la API.

La empresa también está actualizando sus SDK de Python y TypeScript, añadiendo soporte beta para uso de computadora y uso de navegador.

Noticias de IA sin hype – Curado por humanos

Suscríbete a THE DECODER para leer sin publicidad, un boletín semanal de IA, nuestro exclusivo informe de frontera "AI Radar" seis veces al año, acceso completo al archivo y acceso a nuestra sección de comentarios.

Fuente: Anthropic
Fuente original

The Decoder

Notas sobre el contenido

La publicación original y los derechos pertenecen a la fuente.

Traducción automática · Consulte el original