Anthropic hat Claude Haiku 5.5veröffentlicht, sein bisher günstigstes und schnellstes kleines Modell. Es zielt auf hochvolumige Arbeiten wie Zusammenfassungen, Kompaktierung, Klassifizierung und Subagent-Aufgaben ab. Es behält ein 1M Token Kontextfenster und bis zu 128K Output-Tokens. Die Preise beginnen bei $0.10 pro Million Eingabe-Tokens und $0.50 pro Million Ausgabe-Tokens. Das liegt 90% unter Claude Haiku 4.5 für Prompts bis 100K Tokens.
Ist es einsetzbar? Ja, als gehostete API. Haiku 5.5 ist allgemein verfügbar über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS.
Was Anthropic ausgeliefert hat
Haiku 5.5 ist das erste Modell der Haiku-Klasse mit einer einstellbaren Effort-Einstellung. Adaptive thinking ist standardmäßig aktiviert, und der effort parameter steht standardmäßig auf medium.
Es nimmt Text und Bilder entgegen, gibt Text aus und hat einen Wissensstand von Juni 2026. Batch-Jobs unterstützen bis zu 300K Ausgabe-Tokens in der Beta.
Es ist wichtig, zwei zentrale Punkte zu beachten. Nicht voreingestellte temperature, top_p oder top_k -Werte geben einen 400-Fehler zurück. Der neue Tokenizer zählt denselben Text auch mit etwa 30% mehr Tokens als Haiku 4.5. Der Migrationsleitfaden behandelt beides.
Preise: Eine 2-stufige Struktur
Die Preise teilen sich bei 100K Prompt-Tokens. Bis 100K kostet die Eingabe $0.10 und die Ausgabe $0.50 pro Million. Cache-Lesezugriffe kosten $0.01 und 5-minütige Cache-Schreibzugriffe $0.125. Über 100K steigen die Sätze auf $0.50 Eingabe und $2.50 Ausgabe.
Haiku 4.5 kostete $1 Eingabe und $5 Ausgabe. Laut Anthropic blieben etwa 90% der Haiku 4.5-Anfragen unter 100K Tokens. Nach Anpassung an den Tokenizer schätzt Anthropic, dass Haiku 5.5 im Durchschnitt etwa 75% günstiger läuft. Batch-Verarbeitung senkt die Kosten um weitere 50%.
GPT-6 Luna listet identische Sätze für kurze Kontexte. Seine höhere Stufe beginnt erst über 272K Eingabe-Tokens, bei $0.20 und $0.75. Für einen 150K-Token-Prompt ist Luna beim Listenpreis günstiger.
Benchmarks
Alle folgenden Zahlen sind von Anthropic berichtet (siehe die System Card):
- OSWorld 2.1 (Offline-Subset): 72,4 %, gegenüber 48,9 % für GPT-6 Luna und 15,7 % für Haiku 4.5.
- Terminal-Bench 4.0: 39,2 %, gegenüber 16,4 % für Luna und 0,0 % für Haiku 4.5.
- FrontierCode 1.1 (Main): 46,4 %, gegenüber 42,4 % für Luna.
- Humanity’s Last Exam: 45,9 % ohne Werkzeuge und 57,4 % mit Werkzeugen.
- GDPval-AA v2.1: 1620, gegenüber 1437 für Luna und 735 für Haiku 4.5.
Sonnet 5.5 führt weiterhin in jeder Zeile, einschließlich 70,6 % auf Terminal-Bench 4.0. Anthropic selbst empfiehlt Sonnet 5.5 und Opus 5.5 für komplexes agentisches Coding.
Beste Anwendungsfälle
Drei Workloads passen am besten zu Haiku 5.5:
- Der erste ist Subagent-Arbeit unter Opus 5.5 oder Sonnet 5.5. Bei Rogo zieht ein Haiku-5.5-Subagent eine 10-K-Umsatzzeile, während ein größeres Modell das Deck erstellt.
- Der zweite ist Dokumenten-Q&A und Zusammenfassung im hohen Volumen. AlphaSense hat es an einem Feature getestet, das etwa 8M Aufrufe pro Woche verarbeitet.
- Der dritte ist geschwindigkeitssensible Arbeit wie Live-Kundensupport und Browser-Nutzung.
Haiku 5.5 im Vergleich zu seinen nächsten Konkurrenten
| Merkmal | Claude Haiku 5.5 | GPT-6 Luna | Gemini 3.5 Flash-Lite |
|---|---|---|---|
| Eingabe / Ausgabe (pro 1M) | $0.10 / $0.50 | $0.10 / $0.50 | $0.30 / $2.50 |
| Preise für lange Prompts | $0.50 / $2.50 über 100K | $0.20 / $0.75 über 272K | Pauschaltarif |
| Cache-Lesen (pro 1M) | $0.01 | $0.01 | $0.03 + Speicher |
| Kontextfenster | 1M Token | 1,050,000 Token | 1,048,576 Token |
| Maximale Ausgabe | 128K Token | 128,000 Token | 65,536 Token |
| Eingaben | Text, Bilder | Text, Bilder | Text, Bild, Video, Audio, PDF |
| Steuerung des Reasonings | Adaptives Denken + Aufwand (Standard: mittel) | reasoning.effort none bis max (Standard: mittel) | Denken unterstützt |
| Computernutzung | SDK-Unterstützung in der Beta | Unterstützt (Responses API) | Unterstützt (Vorschau) |
| Batch-Rabatt | 50% | 50% (Batch und Flex) | 50% |
| Wissensstand | Juni 2026 | 18. Mai 2026 | Nicht auf der Modellseite aufgeführt |
| Wo ausführen | Claude API, Bedrock, Google Cloud, Microsoft Foundry, Claude Platform auf AWS | OpenAI API | Gemini API |
Quellen: Anthropic-Dokumentation, Anthropic-Ankündigung, OpenAI-Modellseite, OpenAI-Preise, Google-Modellseite, Google-Preise. Listenpreise der Standardstufe, überprüft am 7. Oktober 2026.
Interaktiver Explainer
Kernerkenntnisse
- $0.10 Eingabe und $0.50 Ausgabe pro 1M Tokens für Prompts bis 100K Tokens.
- 1M Kontext, 128K Ausgabe, adaptives Denken mit einer Effort-Einstellung (Standard
medium). - 72.4% bei OSWorld 2.1 gegenüber 15.7% bei Haiku 4.5 (von Anthropic berichtet).
- Gleicher Listenpreis im kurzen Kontext wie GPT-6 Luna; Luna ist über 100K Tokens hinaus günstiger.
- Positioniert als Subagent unter Opus 5.5 und Sonnet 5.5, nicht als Coding-Lead.
Schauen Sie sich die Technical Details an. Alle Credits gehen an die Forscherin/den Forscher dieses Projekts. Folgen Sie uns außerdem gerne auf Twitter und vergessen Sie nicht, unserem 150k+ML SubReddit beizutreten und unseren Newsletter zu abonnieren. Moment! Sind Sie auf Telegram? jetzt können Sie uns auch auf Telegram beitreten.
Der Beitrag Anthropic veröffentlicht Claude Haiku 5.5: Ein kleines Modell mit 1M Kontext zum Preis von $0.10 pro Million Input-Token erschien zuerst auf MarkTechPost.