Presentamos Claude Haiku 5.5: el modelo pequeño más barato, rápido y capaz que hemos lanzado hasta ahora.
Claude Haiku 5.5 está diseñado para tareas de alto volumen y sensibles al costo. Maneja de manera confiable cargas de trabajo rápidas y repetitivas (como resúmenes, compactaciones, consultas a bases de datos y solicitudes de clasificación). Funciona bien junto con Opus 5.5 y Sonnet 5.5 como subagente en tareas de programación. Y, dado que también es nuestro modelo más rápido hasta la fecha, funciona especialmente bien en tareas sensibles a la velocidad, como la atención al cliente en vivo y el uso del navegador.¹
Haiku 5.5 está disponible a un precio mucho más bajo que Haiku 4.5. En promedio, ahora cuesta alrededor de un 75% menos ejecutarlo.²
Junto con este lanzamiento, estamos haciendo mejoras al valor de nuestra gama de modelos. Estamos reduciendo a la mitad el precio de las lecturas de caché de Claude Sonnet 5.5, lo que significa que Sonnet 5.5 ahora funciona alrededor de un 20% más barato en la mayoría de los trabajos de agentes. Y estamos introduciendo un nuevo crédito mensual de API para nuestros suscriptores de Claude Max y Team, diseñado para apoyar a nuestros usuarios en la creación de nuevos agentes y aplicaciones que se ejecutan en la Claude Platform.
Rendimiento
Así se desempeña Claude Haiku 5.5 en una serie de benchmarks:
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5Como referencia | |
|---|---|---|---|---|
| Trabajo del conocimientoGDPval-AA v2.1 | 1620 | 735 | 1437 | 1840 |
| Trabajo del conocimientoAA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| Uso de computadoraOSWorld 2.1 | 72.4%Subconjunto sin conexión | 15.7%Subconjunto sin conexión | 48.9%Subconjunto sin conexión | 83.9%Subconjunto sin conexión |
| Razonamiento multidisciplinarioHumanity’s Last Exam | 45.9%sin herramientas | 10.2%sin herramientas | — | 56.9%sin herramientas |
| 57.4%con herramientas | 18.7%con herramientas | — | 64.5%con herramientas | |
| Programación agénticaTerminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| Programación agénticaFrontierCode 1.1 (Main) | 46.4% | — | 42.4% | 52.1%Xhigh |
| Razonamiento visualChartography | 46.4%sin herramientas | 6.4%sin herramientas | 29.1%sin herramientas | 61.6%sin herramientas |
Para más detalles sobre cómo realizamos nuestras evaluaciones, consulte el Haiku 5.5 System Card.
Haiku 5.5 es nuestro primer modelo de clase Haiku que incluye un ajuste de esfuerzo configurable. Esto significa que, al igual que con nuestros otros modelos, los usuarios pueden decidir si optimizan por costo o por inteligencia. Los gráficos siguientes muestran el rendimiento de Haiku 5.5 en tres benchmarks con cada ajuste de esfuerzo:
OSWorld 2.1 mide qué tan bien los agentes pueden operar una computadora real para completar tareas largas de varios pasos.
El GDPval-AA v2.1 de Artificial Analysis evalúa a los agentes en trabajo profesional del mundo real en 44 ocupaciones.
Humanity’s Last Exam (HLE) es una prueba de conocimiento académico y razonamiento de nivel experto.
En pruebas tempranas, nuestros clientes reportaron resultados consistentes con las mejoras de rendimiento y costo mostradas anteriormente. Esto es lo que nos dijeron sobre el nuevo modelo:
CitaEmpresaAsanaAutorAaron Vinh, Ingeniero de Software en Plantilla“Estamos muy impresionados con Claude Haiku 5.5, particularmente con su velocidad. Lo pusimos a prueba en nuestro conjunto de evaluaciones para AI Teammates, nuestro producto de agente de IA, que cubre casos de uso como la clasificación de errores, la configuración de proyectos y la búsqueda en grandes carteras para detectar trabajo de alto riesgo o atrasado. En comparación con el modelo que usamos hoy, vimos una reducción de más del 30% en la latencia de finalización de tareas y una inferencia hasta 2.5 veces más rápida por turno de agente. Es una experiencia notablemente más ágil.”
Precios
La tabla siguiente muestra cómo se compara el precio de Claude Haiku 5.5 con el de nuestros otros modelos. Haiku 5.5 ofrece especialmente buena relación calidad-precio cuando se usa para tareas con prompts de hasta 100,000 tokens, que representan alrededor del 90% de las solicitudes a nuestro modelo Haiku anterior.
| Precio por 1 millón de tokens | Haiku 5.5 prompts de hasta / más de 100k | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Lecturas de caché | $0.01 / $0.05 | $0.10 | $0.10 |
| Escrituras de caché | $0.125 / $0.625 | $1.25 | $2.50 |
| Tokens de entrada | $0.10 / $0.50 | $1.00 | $2.00 |
| Tokens de salida | $0.50 / $2.50 | $5.00 | $10.00 |
Seguridad
Alineación. Claude Haiku 5.5 muestra mejoras significativas en casi todas nuestras evaluaciones de alineación en comparación con Haiku 4.5. En particular, encontramos muchos menos casos de comportamiento desalineado y una menor disposición a cooperar con usos indebidos. La system card del modelo describe nuestro proceso de evaluación y los resultados con más detalle.
Salvaguardas. De acuerdo con sus capacidades, las salvaguardas de ciberseguridad de Haiku 5.5 son más restrictivas que las de Haiku 4.5, pero algo menos restrictivas que las que hemos aplicado a otros modelos recientes. En ciberseguridad, permiten una gama más amplia de tareas defensivas que nuestras salvaguardas para Sonnet 5.5, pero aún bloquean las pruebas de penetración y otras técnicas con mayor probabilidad de ser utilizadas por atacantes.
Las salvaguardas de biología de Haiku 5.5 son las mismas que para Sonnet 5, Sonnet 5.5 y Opus 5. Permiten preguntas de biología de investigación pero restringen el acceso a solicitudes que consideramos probable que causen daño. Las organizaciones que trabajan en actividades biológicas y cibernéticas más amplias pueden postular a nuestro Life Sciences Verification Program y Cyber Verification Program.
Disponibilidad
Claude Haiku 5.5 ya está disponible en todas las plataformas, incluidas Amazon Web Services, Google Cloud y Microsoft Azure. En la Claude Platform, los desarrolladores pueden comenzar con claude-haiku-5-5.
Consulte nuestra guía de migración para más detalles.
Otras actualizaciones
Junto con nuestros nuevos precios para Claude Haiku 5.5, estamos realizando más mejoras en el valor de nuestros modelos y productos.
Primero, a partir de hoy, estamos reduciendo el precio de las lecturas de caché en Claude Sonnet 5.5. Las lecturas de caché ahora cuestan un 50% menos: $0.10 por millón de tokens en lugar de $0.20. Dado que las lecturas de caché representan una gran parte del consumo de tokens de los modelos, esto reduce el costo de Sonnet 5.5 en la mayoría de las tareas agénticas en alrededor de un 20%.
Por ejemplo, esto es lo que significa el recorte de precios para el rendimiento de Sonnet 5.5 en relación con el costo en Terminal-Bench 4.0:
Terminal-Bench 4.0 mide qué tan bien puede un modelo completar tareas profesionales complejas de varios pasos dentro de una interfaz de línea de comandos.
Este gráfico ilustra una diferencia importante entre Haiku 5.5 y nuestros modelos más grandes. Sonnet 5.5 y Opus 5.5 siguen siendo mejores opciones para tareas agénticas de codificación complejas como las medidas por Terminal-Bench 4.0. En cambio, Haiku 5.5 es más adecuado para tareas de alcance más limitado que, de otro modo, habrían sido prohibitivas en costo con versiones anteriores de Claude, como la compactación, la resumición o el trabajo de subagentes.
Segundo, esta semana lanzaremos un nuevo crédito mensual de API para todos los suscriptores de Max y Team, para su uso en la Claude Platform. Los usuarios de Max 5x recibirán $100 en créditos por mes, los usuarios de Max 20x recibirán $200, y los suscriptores de Team recibirán hasta $500, agrupados entre sus usuarios. Estos créditos están diseñados para permitir a nuestros usuarios experimentar con la creación de herramientas, aplicaciones y agentes que llamen a nuestra API. Pueden usarse con cualquiera de nuestros modelos. Para más información, consulte nuestro artículo del Centro de ayuda.
Para los desarrolladores, también estamos actualizando nuestros SDK de Python y TypeScript de Claude para añadir soporte de computer use y browser use en versión beta. Haiku 5.5 es especialmente adecuado para estas tareas, dada su combinación de velocidad, capacidad y precio. Puede leer más sobre esto en la documentación de nuestra Claude Platform.
Notas al pie
1 Claude Haiku 5.5 es nuestro modelo más rápido hasta la fecha a la velocidad estándar de cada modelo, aunque funciona menos rápido que nuestros modelos Opus en Fast Mode.
2 Claude Haiku 5.5 tiene un precio un 90% más bajo que Claude Haiku 4.5 para solicitudes de hasta 100,000 tokens, y un 50% más bajo para solicitudes de más de 100,000 tokens. En Haiku 4.5, el 90% de las solicitudes caían en la primera categoría. Este cálculo también tiene en cuenta los cambios entre Haiku 4.5 y Haiku 5.5 en cuántos tokens se usan para completar una tarea determinada: Haiku 5.5 tiene un tokenizador actualizado (similar al de Sonnet 5.5 y al de Opus 5.5), lo que significa que utiliza ligeramente más tokens por tarea.
