Claude Haiku 5.5 kommt mit massiven Preissenkungen und beweist, dass das Preisduelle im KI-Bereich längst nicht vorbei ist
Matthias Bastian
LinkedIn-Profil von Matthias Bastian ansehen
7. Oktober 2026
Nano Banana Pro, promptiert von THE DECODER
Kernpunkte
- Anthropic hat Claude Haiku 5.5 veröffentlicht, sein schnellstes und günstigstes kleines Modell, das für Massenaufgaben wie Datenabfragen und Kundenservice entwickelt wurde.
- Haiku 5.5 zeigt deutliche Benchmark-Zugewinne gegenüber Haiku 4.5 bei bis zu 90 Prozent niedrigeren Tokenpreisen. Es schlägt OpenAIs Budget-Modell GPT-6 Luna auch in Bereichen wie agentischem Coding.
- Haiku 5.5 ist jetzt auf AWS, Google Cloud und Azure verfügbar. Anthropic halbiert außerdem die Cache-Lese-Kosten von Sonnet 5.5 und führt monatliche API-Guthaben für Abonnenten ein.
Anthropic hat Claude Haiku 5.5 veröffentlicht, das schnellste und günstigste kleine Modell des Unternehmens bislang. Benchmark-Ergebnisse zeigen einen deutlichen Leistungssprung gegenüber dem Vorgänger, und Anthropic senkt auch die Preise für Sonnet 5.5.
Haiku 5.5 ist laut Anthropic für Massenaufgaben mit Kostenbewusstsein konzipiert, etwa Zusammenfassungen, Datenbankabfragen, Klassifizierung und Live-Kundenservice. Im Durchschnitt kostet das Modell etwa 75 Prozent weniger als Haiku 4.5. Bei Anfragen mit Prompts bis zu 100,000 Tokens, die nach Anthropic etwa 90 Prozent aller bisherigen Haiku-Anfragen ausmachen, sinken die Preise um bis zu 90 Prozent. Prompts länger als 100,000 Tokens kosten das Fünffache.
| Preis pro 1 Million Tokens | Haiku 5.5 (Prompts bis zu / über 100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Cache-Lesevorgänge | $0.01 / $0.05 | $0.10 | $0.10 |
| Cache-Schreibvorgänge | $0.125 / $0.625 | $1.25 | $2.50 |
| Eingabe-Tokens | $0.10 / $0.50 | $1.00 | $2.00 |
| Ausgabe-Tokens | $0.50 / $2.50 | $5.00 | $10.00 |
Anthropic weist darauf hin, dass Haiku 5.5 einen aktualisierten Tokenizer verwendet, der pro Aufgabe etwas mehr Tokens verbraucht als sein Vorgänger. Dasselbe geschah bei den Opus 4.x-Modellen, wo der Tokenverbrauch allein durch die Tokenizer-Änderung um etwa 30 Prozent sprang. Die realen Einsparungen dürften also geringer ausfallen, als die Tokenpreise vermuten lassen.
Benchmarks zeigen einen großen Sprung gegenüber Haiku 4.5
Haiku 5.5 erreicht 1,620 Punkte beim Wissens-Benchmark GDPval-AA v2.1, mehr als doppelt so viel wie die 735 Punkte seines Vorgängers. Bei Humanity's Last Exam liegt es bei 45.9 Prozent ohne Werkzeuge und 57.4 Prozent mit Werkzeugen, nach zuvor 10.2 und 18.7 Prozent.Ad
Der größte Sprung liegt beim Computerbedienung, bei der das Modell einen Computer eigenständig bedient. Da Computerbedienung große Mengen an Tokens verbraucht, ist ein billiges, schnelles Modell wie Haiku 5.5 wie gemacht dafür. Es erzielt 72,4 Prozent bei OSWorld-2.1, nach zuvor 15,7 Prozent. Beim agentischen Coding-Benchmark Terminal-Bench 4.0 erreicht es 39,2 Prozent, während Haiku 4.5 null.scorete.
Anthropic listet auch OpenAIs Budget-Modell GPT-6 Luna zum Vergleich, und Haiku 5.5 führt in jeder getesteten Kategorie. Die Referenzwerte von Sonnet 5.5 zeigen jedoch, dass Haiku 5.5 immer noch deutlich hinter Anthropic's größerem Modell zurückliegt.
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 | |
|---|---|---|---|---|
| Knowledge Work / GDPval-AA v2.1 | 1,620 | 735 | 1,437 | 1,840 |
| Knowledge Work / AA-Briefcase v1.1 | 1,578 | 614 | 1,336 | 1824 |
| Computer Use / OSWorld 2.1 | 72.4% (Offline-Teilmenge) | 15,7 % (Offline-Teilmenge) | 48,9 % (Offline-Teilmenge) | 83,9 % (Offline-Teilmenge) |
| Interdisziplinäres Schlussfolgern / Humanity's Last Exam | 45,9 % (ohne Tools) | 10,2 % (ohne Tools) | — | 56,9 % (ohne Tools) |
| 57,4 % (mit Tools) | 18,7 % (mit Tools) | — | 64,5 % (mit Tools) | |
| Agentic Coding / Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| Agentic Coding / FrontierCode 1.1 (Main) | 46.4% | — | 42.4% | 52,1 % (Xhigh) |
| Visuelles Schlussfolgern / Chartography | 46,4 % (ohne Tools) | 6,4 % (ohne Tools) | 29,1 % (ohne Tools) | 61,6 % (ohne Tools) |
Erstes Haiku-Modell lässt Nutzer Kosten gegen Performance tauschen
Haiku 5.5 ist das erste Haiku-Klassen-Modell mit einstellbaren Reasoning-Stufen, mit denen Nutzer Kosten gegen Qualität abwägen können. Anthropic sagt, das Modell eigne sich am besten für eng umrissene Aufgaben wie Komprimierung, Zusammenfassung oder Sub-Agent-Arbeit. Für komplexes agentic coding bleiben Sonnet 5.5 und Opus 5.5 die bessere Wahl.
Die Cybersicherheits-Sicherheitsvorkehrungen sind strenger als beim Vorgänger, erlauben aber ein breiteres Spektrum defensiver Aufgaben als Sonnet 5.5, teils weil das Modell insgesamt weniger leistungsfähig ist. Penetrationstests bleiben blockiert. Organisationen mit weitergehenden Anforderungen können sich bewerben für Anthropics Verifizierungsprogramme für Lebenswissenschaften und Cybersicherheit.Werbung
Haiku 5.5 ist ab sofort auf allen Plattformen verfügbar, darunter Amazon Web Services, Google Cloud und Microsoft Azure.
Sonnet 5.5 wird ebenfalls günstiger, und Anthropic verschenkt API-Guthaben
Zusammen mit dem Haiku-Launch senkt Anthropic die Cache-Lesekosten für Sonnet 5.5 um 50 Prozent, von $0.20 auf $0.10 pro Million Tokens. Das Unternehmen sagt, dies dürfte die Kosten für die meisten agentic tasks um etwa 20 Prozent reduzieren. Der Schritt ist mit ziemlicher Sicherheit eine Reaktion auf OpenAIs neue GPT-6.1-Serie, was zeigt, dass die KI-Preisschlachten härter geführt werden als je zuvor.
Anthropic führt außerdem monatliche API-Gutschriften ein. Max-5x-Abonnenten erhalten $100, Max-20x-Abonnenten $200, und Team-Abonnenten bekommen bis zu $500 pro Monat. Nutzer können die Gutschriften ausgeben, um über die API mit Tools, Apps und Agenten zu experimentieren.
Das Unternehmen aktualisiert auch seine Python- und TypeScript-SDKs und fügt Beta-Unterstützung hinzu für computer use und browser use.
KI-News ohne Hype – kuratiert von Menschen
Abonniere THE DECODER für werbefreies Lesen, einen wöchentlichen KI-Newsletter, unseren exklusiven Frontier-Bericht „AI Radar“ sechsmal im Jahr, vollen Archivzugang und Zugang zu unserem Kommentarbereich.
Quelle: Anthropic