Anthropic ha lanzado Claude Haiku 5.5, su modelo pequeño más barato y rápido hasta la fecha. Está dirigido a trabajos de alto volumen como resúmenes, compactación, clasificación y tareas de subagentes. Mantiene una ventana de contexto de 1M de tokens y hasta 128K de tokens de salida. El precio parte de $0.10 por millón de tokens de entrada y $0.50 por millón de tokens de salida. Eso es un 90% menos que Claude Haiku 4.5 para prompts de hasta 100K tokens.
¿Es desplegable? Sí, como una API alojada. Haiku 5.5 está generalmente disponible en la API de Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform en AWS.
Lo que Anthropic lanzó
Haiku 5.5 es el primer modelo de clase Haiku con un ajuste de esfuerzo configurable. Adaptive thinking está activado por defecto, y el parámetro effort tiene por defecto medium.
Acepta texto e imágenes, produce texto y tiene un corte de conocimiento de junio de 2026. Los trabajos por lotes admiten hasta 300K de tokens de salida en beta.
Es importante señalar dos cosas clave. Los valores temperature, top_p o top_k no predeterminados devuelven un error 400. El nuevo tokenizador también cuenta el mismo texto como aproximadamente un 30% más de tokens que Haiku 4.5. La guía de migración cubre ambos puntos.
Precios: una estructura de 2 niveles
El precio se divide en 100K tokens de prompt. Hasta 100K, la entrada cuesta $0.10 y la salida $0.50 por millón. Las lecturas de caché cuestan $0.01 y las escrituras de caché de 5 minutos $0.125. Por encima de 100K, las tarifas suben a $0.50 de entrada y $2.50 de salida.
Haiku 4.5 cobraba $1 de entrada y $5 de salida. Anthropic dice que alrededor del 90% de las solicitudes de Haiku 4.5 se mantenían por debajo de 100K tokens. Tras ajustar por el tokenizador, estima que Haiku 5.5 funciona en promedio alrededor de un 75% más barato. El procesamiento por lotes aplica otro 50% de descuento.
GPT-6 Luna lista tarifas idénticas para contextos cortos. Su nivel superior comienza solo por encima de 272K tokens de entrada, a $0.20 y $0.75. Para un prompt de 150K tokens, Luna es más barata en precio de lista.
Benchmarks
Todas las cifras a continuación son informadas por Anthropic (véase la tarjeta del sistema):
- OSWorld 2.1 (subconjunto sin conexión): 72.4%, frente al 48.9% de GPT-6 Luna y al 15.7% de Haiku 4.5.
- Terminal-Bench 4.0: 39.2%, frente al 16.4% de Luna y al 0.0% de Haiku 4.5.
- FrontierCode 1.1 (Main): 46.4%, frente al 42.4% de Luna.
- Humanity’s Last Exam: 45.9% sin herramientas y 57.4% con herramientas.
- GDPval-AA v2.1: 1620, frente a 1437 de Luna y 735 de Haiku 4.5.
Sonnet 5.5 sigue liderando cada fila, incluido un 70.6% en Terminal-Bench 4.0. El propio Anthropic recomienda Sonnet 5.5 y Opus 5.5 para codificación agéntica compleja.
Mejores casos de uso
Tres cargas de trabajo encajan mejor con Haiku 5.5:
- La primera es el trabajo de subagentes bajo Opus 5.5 o Sonnet 5.5. En Rogo, un subagente Haiku 5.5 extrae una línea de ingresos de un 10-K mientras un modelo más grande construye la presentación.
- La segunda es preguntas y respuestas y resumen de documentos a gran volumen. AlphaSense lo probó en una función que maneja alrededor de 8M de llamadas a la semana.
- La tercera es el trabajo sensible a la velocidad, como la atención al cliente en vivo y el uso del navegador.
Haiku 5.5 frente a sus competidores más cercanos
| Característica | Claude Haiku 5.5 | GPT-6 Luna | Gemini 3.5 Flash-Lite |
|---|---|---|---|
| Entrada / salida (por 1M) | $0.10 / $0.50 | $0.10 / $0.50 | $0.30 / $2.50 |
| Precios de prompts largos | $0.50 / $2.50 por encima de 100K | $0.20 / $0.75 por encima de 272K | Tarifa fija |
| Lectura de caché (por 1M) | $0.01 | $0.01 | $0.03 + almacenamiento |
| Ventana de contexto | 1M de tokens | 1,050,000 tokens | 1,048,576 tokens |
| Salida máxima | 128K de tokens | 128,000 tokens | 65,536 tokens |
| Entradas | Texto, imágenes | Texto, imágenes | Texto, imagen, video, audio, PDF |
| Control de razonamiento | Pensamiento adaptativo + esfuerzo (medio por defecto) | reasoning.effort de none a max (medio por defecto) | Pensamiento admitido |
| Uso de computadora | Soporte de SDK en beta | Admitido (Responses API) | Admitido (Vista previa) |
| Descuento por lotes | 50% | 50% (Batch y Flex) | 50% |
| Fecha de corte de conocimiento | Junio de 2026 | 18 de mayo de 2026 | No aparece en la página del modelo |
| Dónde ejecutar | Claude API, Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS | OpenAI API | Gemini API |
Fuentes: Documentación de Anthropic, Anuncio de Anthropic, Página del modelo de OpenAI, Precios de OpenAI, Página del modelo de Google, Precios de Google. Precios de lista de nivel estándar, verificados el 7 de octubre de 2026.
Explicación interactiva
Puntos clave
- $0.10 de entrada y $0.50 de salida por 1M de tokens para prompts de hasta 100K tokens.
- Contexto de 1M, salida de 128K, pensamiento adaptativo con un ajuste de esfuerzo (por defecto
medium). - 72.4% en OSWorld 2.1 frente al 15.7% de Haiku 4.5 (según lo reportado por Anthropic).
- El mismo precio de lista de contexto corto que GPT-6 Luna; Luna es más económico por encima de 100K tokens.
- Posicionado como subagente bajo Opus 5.5 y Sonnet 5.5, no como líder de codificación.
Echa un vistazo al Detalles técnicos. Todo el mérito es del investigador de este proyecto. Además, no dude en seguirnos en Twitter y no olvide unirse a nuestro 150k+ML SubReddit y suscribirse a nuestro Newsletter. ¡Espere! ¿está en telegram? ahora también puede unirse a nosotros en telegram.
La entrada Anthropic lanza Claude Haiku 5.5: un modelo pequeño con contexto de 1M con un precio de $0.10 por millón de tokens de entrada apareció primero en MarkTechPost.