Anthropic a publié Claude Haiku 5.5, obtenant un score de 43 sur l'Artificial Analysis Intelligence Index — une hausse de 26 points un an après la dernière sortie d'un modèle Haiku
Voir la page du modèleHaiku 5.5 est le premier modèle Haiku doté des paramètres d'effort et de la réflexion adaptative d'Anthropic, et Anthropic a introduit une tarification par paliers.
Haiku 5.5 est moins cher que son prédécesseur — il coûte $0.10/$0.50 par 1M de tokens d'entrée/sortie pour des invites allant jusqu'à 100k tokens (comme GPT-6 Luna et 10% du modèle Haiku précédent). Cependant, cette tarification augmente d'un facteur 5, à $0.50/$2.50 au-delà de 100k. Le site ne reflète pas encore la tarification par paliers, de sorte que les chiffres provisoires de coût pour Haiku 5.5 n'incluent pas ce supplément. Nous travaillons sur la prise en charge et suivrons bientôt avec une couverture Cost per Task.
Points clés :
➤ Des performances de premier plan dans la classe des petits modèles : À effort maximum, Haiku 5.5 se situe légèrement devant des modèles tels que GLM-5.3 Flash (42), Gemini 3.8 Flash (41) et GPT-6 Luna (38). Son score est comparable à celui de Kimi K3 (44), un modèle à poids ouverts de 2.8T de paramètres, et il est à 13 points derrière Claude Sonnet 5.5 (max, 56)
➤ Utilisation importante de tokens par rapport à GPT-6 Luna : Haiku 5.5 (max) utilise ~162k tokens de sortie par tâche de l'Intelligence Index, soit ~3x GPT-6 Luna (max, ~50k). Passer de xhigh à max ajoute 2 points pour ~1.8x les tokens. À intelligence similaire, il utilise également plus de tokens que GPT-6 Luna : Haiku 5.5 (high) obtient 38 avec ~55k tokens par tâche contre 38 avec ~50k pour Luna (max), et l'écart se creuse aux paramètres d'effort plus faibles
➤ Très performant dans le travail de connaissance agentique : sur AA-Briefcase, notre évaluation privée des tâches de travail de connaissance réalistes, Haiku 5.5 (max) atteint 1578 Elo, devant des modèles dont Kimi K3 et GLM-5.3, et comparable à Muse Spark 1.3 (max)
➤ Améliorations dans l'utilisation du terminal : sur Terminal-Bench 4.0, il obtient 33%, contre 0% pour Haiku 4.5. Cela égale GLM-5.3 Flash, et dépasse Gemini 3.8 Flash (20%) et GPT-6 Luna (13%)
➤ Connaissances factuelles plus faibles, mais hallucinations relativement peu fréquentes : comme on peut s'y attendre pour un modèle de classe plus petite, Haiku 5.5 a des connaissances factuelles inférieures à celles de ses homologues. La précision sur AA-Omniscience est de 36%, contre 55% pour Gemini 3.8 Flash et 44% pour GPT-6 Luna, mais cela s'explique en partie par une plus grande disposition à admettre qu'il ne sait pas — son taux d'hallucination est plus faible, à 40% contre 55% et 77%
➤ Résultat sur AutomationBench-AA probablement sous-estimé : Haiku 5.5 obtient 35%, contre 53–60% pour GPT-6 Luna, Gemini 3.8 Flash et GLM-5.3 Flash. Pendant les tests de pré-lancement, un problème de refus lié à la sécurité a conduit le modèle à refuser excessivement. Anthropic travaille à résoudre ce problème — nous relancerons cette évaluation avec le correctif et nous attendons à ce que ce score augmente
Autres détails du modèle :
➤ Fenêtre de contexte : 1 million de tokens, contre 200k pour Claude 4.5 Haiku
➤ Tarification : $0.10/$0.50 par 1M de tokens d'entrée/sortie jusqu'à 100k tokens, $0.50/$2.50 au-delà. Lectures de cache $0.01 ($0.05 au-delà de 100k), écritures de cache de 5 minutes $0.125 ($0.625 au-delà de 100k)
➤ Multimodalité : Entrée texte et image, avec sortie texte

Claude Haiku 5.5 (max) utilise ~162k tokens de sortie par tâche de l'Intelligence Index, soit plus que Opus 5.5 (max) et ~3x GPT-6 Luna (max). Sur l'ensemble des paramètres d'effort, Haiku 5.5 utilise plus de tokens de sortie que GPT-6 Luna pour atteindre des scores similaires sur l'Intelligence Index

Claude Haiku 5.5 (max) atteint 1578 Elo sur AA-Briefcase, notre évaluation privée du travail de connaissance de pointe, dans les intervalles de confiance de GPT-6 Astra (max) et Claude Fable 5.1 (high)

Décomposition complète des évaluations individuelles de l'Artificial Analysis Intelligence Index pour Claude Haiku 5.5 selon les paramètres d'effort

