Claude Haiku 5.5带着大幅降价登场,证明AI价格军备竞赛远未结束
Matthias Bastian
查看Matthias Bastian的LinkedIn个人主页
2026年10月7日
Nano Banana Pro,由THE DECODER提示生成
要点
- Anthropic发布了Claude Haiku 5.5,这是其速度最快、价格最实惠的小型模型,专为数据查询和客户支持等高吞吐量任务而构建。
- Haiku 5.5在基准测试中较Haiku 4.5取得重大提升,同时token价格最多低90%。它还在代理式编码等领域击败了OpenAI的廉价模型GPT-6 Luna。
- Haiku 5.5现已在AWS、Google Cloud和Azure上可用。Anthropic还将Sonnet 5.5的缓存读取成本削减一半,并为订阅用户推出每月API额度。
Anthropic发布了Claude Haiku 5.5,这是该公司迄今为止速度最快、价格最实惠的小型模型。基准测试结果显示其性能较前代大幅跃升,Anthropic还下调了Sonnet 5.5的价格。
据Anthropic介绍,Haiku 5.5专为摘要、数据库查询、分类和实时客户支持等高吞吐量、成本敏感的任务而设计。平均而言,该模型的成本比Haiku 4.5低约75%。对于提示词不超过100,000 token的请求,价格最多下降90%,Anthropic称此类请求约占以往所有Haiku请求的90%。超过100,000 token的提示词价格则高出五倍。
| 每1百万token价格 | Haiku 5.5(提示词不超过/超过100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 缓存读取 | $0.01 / $0.05 | $0.10 | $0.10 |
| 缓存写入 | $0.125 / $0.625 | $1.25 | $2.50 |
| 输入token | $0.10 / $0.50 | $1.00 | $2.00 |
| 输出token | $0.50 / $2.50 | $5.00 | $10.00 |
Anthropic指出,Haiku 5.5使用了更新后的分词器,每任务消耗的token略多于前代。同样的情况 也发生在Opus 4.x系列模型上,仅分词器变更就导致token使用量增加了约30%。实际节省很可能低于每token价格所显示的水平。
基准测试显示较Haiku 4.5大幅跃升
Haiku 5.5在知识基准GDPval-AA v2.1上得分为1,620,是前代735分的两倍多。在Humanity's Last Exam上,无工具时得分45.9%,有工具时得分57.4%,而此前分别为10.2%和18.7%。广告
最大幅度的跃升出现在 计算机使用领域,即模型自主操作计算机。由于计算机使用会消耗大量token,像Haiku 5.5这样廉价快速的模型是天然之选。它在OSWorld-2.1上得分72.4%,而此前为15.7%。在代理式编码基准Terminal-Bench 4.0上,它达到39.2%,而Haiku 4.5得分为零。
Anthropic还列出了OpenAI的廉价模型 GPT-6 Luna 作为对比,Haiku 5.5 在所有测试类别中均处于领先地位。然而,Sonnet 5.5 的参考分数表明,Haiku 5.5 仍远远落后于 Anthropic 更大的模型。
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 | |
|---|---|---|---|---|
| 知识工作 / GDPval-AA v2.1 | 1,620 | 735 | 1,437 | 1,840 |
| 知识工作 / AA-Briefcase v1.1 | 1,578 | 614 | 1,336 | 1824 |
| 计算机使用 / OSWorld 2.1 | 72.4%(离线子集) | 15.7%(离线子集) | 48.9%(离线子集) | 83.9%(离线子集) |
| 多学科推理 / Humanity's Last Exam | 45.9%(无工具) | 10.2%(无工具) | — | 56.9%(无工具) |
| 57.4%(有工具) | 18.7%(有工具) | — | 64.5%(有工具) | |
| 智能体编程 / Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| 智能体编程 / FrontierCode 1.1 (Main) | 46.4% | — | 42.4% | 52.1%(Xhigh) |
| 视觉推理 / Chartography | 46.4%(无工具) | 6.4%(无工具) | 29.1%(无工具) | 61.6%(无工具) |
首款 Haiku 模型让用户用成本换取性能
Haiku 5.5 是首款具备可调推理级别的 Haiku 级模型,让用户可以在成本与质量之间取得平衡。Anthropic 表示,该模型最适用于范围狭窄的任务,例如压缩、摘要或子智能体工作。对于复杂的智能体编程,Sonnet 5.5 和 Opus 5.5 仍是更好的选择。
网络安全防护措施比前代模型更严格,但允许的防御性任务范围比 Sonnet 5.5 更广,部分原因是该模型整体能力较弱。渗透测试仍然被禁止。有更广泛需求的组织可以申请 Anthropic 的生命科学和网络安全验证计划。广告
Haiku 5.5 现已在所有平台可用,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。
Sonnet 5.5 也变得更便宜,Anthropic 还发放 API 额度
随 Haiku 发布,Anthropic 将 Sonnet 5.5 的缓存读取成本降低了 50%,从每百万 token 0.20 美元降至 0.10 美元。公司表示,这应能将大多数智能体任务的成本降低约 20%。此举几乎可以肯定是对 OpenAI 新的 GPT-6.1 系列的回应,表明 AI 价格战正以前所未有的激烈程度展开。
Anthropic 还推出了每月 API 额度。Max-5x 订阅者可获得 100 美元,Max-20x 订阅者可获得 200 美元,Team 订阅者每月最高可获得 500 美元。用户可以通过 API 使用这些额度来试验工具、应用和智能体。
公司还在更新其 Python 和 TypeScript SDK,添加对以下功能的 beta 支持: 计算机使用和浏览器使用.
没有炒作的 AI 新闻 – 由人工精心筛选
订阅 THE DECODER,即可享受无广告阅读、每周 AI 新闻通讯、每年六期独家“AI Radar”前沿报告、完整档案访问权限以及评论区访问权限。
来源: Anthropic