Claude Haiku 5.5 arrive avec des baisses de prix massives prouvant que la course aux prix de l'IA est loin d'être terminée
Matthias Bastian
Voir le profil LinkedIn de Matthias Bastian
7 oct. 2026
Nano Banana Pro, prompt de THE DECODER
Points clés
- Anthropic a publié Claude Haiku 5.5, son plus rapide et plus abordable petit modèle, conçu pour les tâches à fort volume comme les requêtes de données et le support client.
- Haiku 5.5 affiche des gains de benchmark majeurs par rapport à Haiku 4.5 avec des prix de tokens jusqu'à 90 pour cent inférieurs. Il surpasse également le modèle économique d'OpenAI, GPT-6 Luna, dans des domaines comme le codage agentique.
- Haiku 5.5 est disponible dès maintenant sur AWS, Google Cloud et Azure. Anthropic réduit également de moitié les coûts de lecture du cache de Sonnet 5.5 et déploie des crédits API mensuels pour les abonnés.
Anthropic a publié Claude Haiku 5.5, le petit modèle le plus rapide et le plus abordable de l'entreprise à ce jour. Les résultats des benchmarks montrent un bond de performance majeur par rapport à son prédécesseur, et Anthropic réduit également les prix de Sonnet 5.5.
Haiku 5.5 est conçu pour les tâches à fort volume et sensibles aux coûts comme la résumé, les requêtes de base de données, la classification et le support client en direct, selon Anthropic. En moyenne, le modèle coûte environ 75 pour cent de moins que Haiku 4.5. Pour les requêtes avec des prompts allant jusqu'à 100,000 tokens, qui représentent selon Anthropic environ 90 pour cent de toutes les requêtes Haiku précédentes, les prix baissent jusqu'à 90 pour cent. Les prompts de plus de 100,000 tokens coûtent cinq fois plus cher.
| Prix par 1 million de tokens | Haiku 5.5 (prompts jusqu'à / au-delà de 100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Lectures de cache | $0.01 / $0.05 | $0.10 | $0.10 |
| Écritures de cache | $0.125 / $0.625 | $1.25 | $2.50 |
| Tokens d'entrée | $0.10 / $0.50 | $1.00 | $2.00 |
| Tokens de sortie | $0.50 / $2.50 | $5.00 | $10.00 |
Anthropic précise que Haiku 5.5 utilise un tokenizer mis à jour qui consomme légèrement plus de tokens par tâche que son prédécesseur. La même chose s'est produite avec les modèles Opus 4.x, où l'utilisation de tokens a augmenté d'environ 30 pour cent rien qu'à cause du changement de tokenizer. Les économies réelles sont probablement inférieures à ce que suggèrent les prix par token.
Les benchmarks montrent un grand bond par rapport à Haiku 4.5
Haiku 5.5 obtient un score de 1,620 au benchmark de connaissances GDPval-AA v2.1, soit plus du double des 735 obtenus par son prédécesseur. Sur Humanity's Last Exam, il atteint 45.9 pour cent sans outils et 57.4 pour cent avec outils, contre 10.2 et 18.7 pour cent.Pub
Le plus grand bond concerne l'utilisation d'ordinateur, où le modèle utilise un ordinateur de manière autonome. Comme l'utilisation d'ordinateur consomme de grandes quantités de tokens, un modèle bon marché et rapide comme Haiku 5.5 est un choix naturel. Il obtient 72,4 pour cent sur OSWorld-2.1, contre 15,7 pour cent auparavant. Sur le benchmark de codage agentique Terminal-Bench 4.0, il atteint 39,2 pour cent tandis que Haiku 4.5 avait obtenu zéro.
Anthropic liste également le modèle économique d'OpenAI GPT-6 Luna à titre de comparaison, et Haiku 5.5 domine dans toutes les catégories testées. Les scores de référence de Sonnet 5.5 montrent toutefois que Haiku 5.5 reste bien loin derrière le modèle plus grand d'Anthropic.
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 | |
|---|---|---|---|---|
| Travail de connaissance / GDPval-AA v2.1 | 1,620 | 735 | 1,437 | 1,840 |
| Travail de connaissance / AA-Briefcase v1.1 | 1,578 | 614 | 1,336 | 1824 |
| Utilisation de l'ordinateur / OSWorld 2.1 | 72,4 % (sous-ensemble hors ligne) | 15,7 % (sous-ensemble hors ligne) | 48,9 % (sous-ensemble hors ligne) | 83,9 % (sous-ensemble hors ligne) |
| Raisonnement multidisciplinaire / Humanity's Last Exam | 45,9 % (sans outils) | 10,2 % (sans outils) | — | 56,9 % (sans outils) |
| 57,4 % (avec outils) | 18,7 % (avec outils) | — | 64,5 % (avec outils) | |
| Codage agentique / Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| Codage agentique / FrontierCode 1.1 (Main) | 46.4% | — | 42.4% | 52,1 % (Xhigh) |
| Raisonnement visuel / Chartography | 46,4 % (sans outils) | 6,4 % (sans outils) | 29,1 % (sans outils) | 61,6 % (sans outils) |
Premier modèle Haiku permettant aux utilisateurs d'échanger des coûts contre des performances
Haiku 5.5 est le premier modèle de classe Haiku doté de niveaux de raisonnement ajustables, permettant aux utilisateurs d'équilibrer le coût et la qualité. Anthropic indique que le modèle fonctionne mieux pour des tâches au périmètre restreint comme la compaction, la synthèse ou le travail de sous-agent. Pour le codage agentique complexe, Sonnet 5.5 et Opus 5.5 restent de meilleurs choix.
Les mesures de protection en cybersécurité sont plus strictes que sur le prédécesseur mais autorisent un éventail plus large de tâches défensives que Sonnet 5.5, en partie parce que le modèle est globalement moins performant. Les tests d'intrusion restent bloqués. Les organisations ayant des besoins plus larges peuvent postuler aux programmes de vérification d'Anthropic pour les sciences de la vie et la cybersécurité.Pub
Haiku 5.5 est disponible dès maintenant sur toutes les plateformes, y compris Amazon Web Services, Google Cloud et Microsoft Azure.
Sonnet 5.5 devient aussi moins cher, et Anthropic distribue des crédits API
Parallèlement au lancement de Haiku, Anthropic réduit de 50 % les coûts de lecture du cache pour Sonnet 5.5, de 0,20 $ à 0,10 $ par million de jetons. L'entreprise affirme que cela devrait réduire les coûts de la plupart des tâches agentiques d'environ 20 %. Cette décision est presque certainement une réaction à la nouvelle série GPT-6.1 d'OpenAI, montrant que les guerres des prix de l'IA se livrent plus durement que jamais.
Anthropic déploie également des crédits API mensuels. Les abonnés Max-5x reçoivent 100 $, les abonnés Max-20x reçoivent 200 $, et les abonnés Team reçoivent jusqu'à 500 $ par mois. Les utilisateurs peuvent dépenser ces crédits pour expérimenter des outils, des applications et des agents via l'API.
L'entreprise met aussi à jour ses SDK Python et TypeScript, ajoutant une prise en charge bêta de l'usage de l'ordinateur et du navigateur.
L'actualité IA sans le battage – Curated by Humans
Abonnez-vous à THE DECODER pour une lecture sans publicité, une newsletter hebdomadaire sur l'IA, notre rapport exclusif « AI Radar » sur les technologies de pointe six fois par an, un accès complet aux archives et l'accès à notre section de commentaires.
Source : Anthropic