Anthropicは Claude Haiku 5.5をリリースした。これは同社史上最も安価かつ高速な小型モデルである。 このモデルは、要約、圧縮、分類、サブエージェントタスクといった大量処理のワークロードを対象としています。1Mトークンのコンテキストウィンドウと最大128Kの出力トークンを維持します。料金は1M入力トークンあたり$0.10、1M出力トークンあたり$0.50から。これは90%低い水準です Claude Haiku 4.5 100Kトークンまでのプロンプトに対して。
デプロイ可能か? はい、ホスト型APIとして利用可能である。Haiku 5.5は、Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、AWS上のClaude Platformで 一般提供 されている。
Anthropicがリリースしたもの
Haiku 5.5は、調整可能なエフォート設定を備えた初のHaikuクラスモデルである。 Adaptive thinking がデフォルトで有効になっており、 effortパラメータ のデフォルトは medium.
である。テキストと画像を入力として受け取り、テキストを出力し、知識のカットオフは2026年6月である。バッチジョブではベータ版で最大300Kの出力トークンに対応している。
重要な点が2つある。デフォルト以外の temperature, top_p や top_k の値は400エラーを返す。また、新しいトークナイザーは同じテキストをHaiku 4.5より約30%多いトークン数としてカウントする。 移行ガイド が両方を説明している。
価格:2段階の構造
料金は100Kプロンプトトークンを境に分かれています。100Kまでの場合、入力は1Mトークンあたり$0.10、出力は$0.50です。キャッシュ読み取りは$0.01、5分間のキャッシュ書き込みは$0.125です。100Kを超えると、料金は入力$0.50、出力$2.50に上がります。
Haiku 4.5は入力1ドル、出力5ドルだった。Anthropicによると、Haiku 4.5のリクエストの約90%は100Kトークン未満だった。トークナイザーの違いを調整した後、Haiku 5.5は平均で約75%安く実行できると同社は見積もっている。 バッチ処理 ではさらに50%割引される。
GPT-6 Luna は同じショートコンテキスト料金を提示している。その上位 tier は272K入力トークンを超えた場合にのみ適用され、0.20ドルと0.75ドルとなる。150Kトークンのプロンプトでは、リスト価格上はLunaの方が安い。
ベンチマーク
以下の数値はすべて Anthropicが報告したものです (詳細は システムカード):
- OSWorld 2.1 (オフラインサブセット): 72.4%、GPT-6 Lunaは48.9%、Haiku 4.5は15.7%。
- Terminal-Bench 4.0: 39.2%、Lunaは16.4%、Haiku 4.5は0.0%。
- FrontierCode 1.1 (Main): 46.4%、Lunaは42.4%。
- Humanity’s Last Exam: ツールなしで45.9%、ツールありで57.4%。
- GDPval-AA v2.1: 1620、Lunaは1437、Haiku 4.5は735。
Sonnet 5.5はTerminal-Bench 4.0での70.6%を含め、全項目で依然として首位です。Anthropic自身も、複雑なエージェント型コーディングにはSonnet 5.5とOpus 5.5を推奨しています。
最適なユースケース
Haiku 5.5に最も適した3つのワークロードは次のとおりです。
- 1つ目は、Opus 5.5またはSonnet 5.5の下でのサブエージェント作業です。Rogoでは、大きなモデルがデッキを作成する間に、Haiku 5.5のサブエージェントが10-Kの売上ラインを取得します。
- 2つ目は、大量のドキュメントQ&Aと要約です。AlphaSenseは、週に約8M件のコールを処理する機能でこれをテストしました。
- 3つ目は、ライブカスタマーサポートや ブラウザ利用.
Haiku 5.5と最も近い競合の比較
| 機能 | Claude Haiku 5.5 | GPT-6 Luna | Gemini 3.5 Flash-Lite |
|---|---|---|---|
| 入力 / 出力 (1Mあたり) | $0.10 / $0.50 | $0.10 / $0.50 | $0.30 / $2.50 |
| 長いプロンプトの料金設定 | 100K超: $0.50 / $2.50 | 272K超: $0.20 / $0.75 | 均一料金 |
| キャッシュ読み取り(1Mあたり) | $0.01 | $0.01 | $0.03 + ストレージ |
| コンテキストウィンドウ | 1Mトークン | 1,050,000トークン | 1,048,576トークン |
| 最大出力 | 128Kトークン | 128,000トークン | 65,536トークン |
| 入力 | テキスト、画像 | テキスト、画像 | テキスト、画像、動画、音声、PDF |
| 推論コントロール | アダプティブ思考 + 努力レベル(デフォルトはmedium) | reasoning.effort none から max まで(デフォルトはmedium) | 思考に対応 |
| コンピュータ操作 | SDKサポート(ベータ版) | 対応(Responses API) | 対応(プレビュー) |
| バッチ割引 | 50% | 50%(Batch および Flex) | 50% |
| ナレッジカットオフ | 2026年6月 | 2026年5月18日 | モデルページに未掲載 |
| どこで実行するか | Claude API、Bedrock、Google Cloud、Microsoft Foundry、AWS上のClaude Platform | OpenAI API | Gemini API |
出典: Anthropic ドキュメント, Anthropicの発表, OpenAI モデルページ, OpenAIの料金体系, Google モデルページ, Googleの料金設定。スタンダード階級の定価、2026年10月7日時点で確認済み。
インタラクティブ解説
主なポイント
- 1Mトークンあたり入力0.10ドル、出力0.50ドルで、100Kトークンまでのプロンプトに適用されます。
- 1Mのコンテキスト、128Kの出力、 effort 設定(デフォルト付きの適応的思考
medium). - OSWorld 2.1 で 72.4%、Haiku 4.5 は 15.7%(Anthropic 提出値)。
- GPT-6 Lunaと同じ短期コンテキストの定価。ただし100Kトークンを超えるとLunaの方が安くなります。
- Opus 5.5およびSonnet 5.5の下でサブエージェントとして位置づけられており、コーディングリーダーではない。
Check out the → 「チェックしてください」的な… Segment only: "Check out the" → 「以下をご覧ください:」but must translate only. Provide 「こちらをご覧ください:」? Keep simple: 「ぜひご覧ください、」. Better: 「以下をチェックしてみてください:」— but no following context. Just 「チェックしてみてください:」. I'll use 「こちらをチェックしてみてください:」? No "the" nuance... use 「次のものをチェックしてみてください:」Simpler: 「チェックしてみてください:」. Go with 「以下をチェックしてみてください:」— adds "以下" which is a natural rendering of "the". Fine. 技術的詳細。 このプロジェクトの研究者に全ての功績があります。また、ぜひ私たちをフォローしてください。 Twitter そして、私たちの 150k以上のメンバーを抱えるML SubReddit およびSubscribe to 当社のニュースレター. 待って!Telegram(テレグラム)は使っていますか? 今後はTelegramでもご参加いただけます。
この投稿 Anthropic、Claude Haiku 5.5をリリース: 1Mコンテキストを備えた小型モデル、価格は入力トークン1Mあたり0.10ドル の初出は MarkTechPost.