The Decoder

Claude Haiku 5.5带着大幅降价登场,证明AI价格军备竞赛远未结束

Anthropic的新Claude Haiku 5.5在基准测试中大幅超越前代,在OSWorld计算机使用测试上的得分从15.7跃升至72.4。Token价格最多下降90%,不过新的分词器每任务消耗更多token,吞噬了部分节省。文章《Claude Haiku 5.5带着大幅降价登场,证明AI价格军备竞赛远未结束》首发于The Decoder。

Matthias Bastian
配图来源 · The Decoder

Claude Haiku 5.5带着大幅降价登场,证明AI价格军备竞赛远未结束

Matthias Bastian Matthias Bastian 查看Matthias Bastian的LinkedIn个人主页 2026年10月7日 Image description Nano Banana Pro,由THE DECODER提示生成

要点

  • Anthropic发布了Claude Haiku 5.5,这是其速度最快、价格最实惠的小型模型,专为数据查询和客户支持等高吞吐量任务而构建。
  • Haiku 5.5在基准测试中较Haiku 4.5取得重大提升,同时token价格最多低90%。它还在代理式编码等领域击败了OpenAI的廉价模型GPT-6 Luna。
  • Haiku 5.5现已在AWS、Google Cloud和Azure上可用。Anthropic还将Sonnet 5.5的缓存读取成本削减一半,并为订阅用户推出每月API额度。

Anthropic发布了Claude Haiku 5.5,这是该公司迄今为止速度最快、价格最实惠的小型模型。基准测试结果显示其性能较前代大幅跃升,Anthropic还下调了Sonnet 5.5的价格。

据Anthropic介绍,Haiku 5.5专为摘要、数据库查询、分类和实时客户支持等高吞吐量、成本敏感的任务而设计。平均而言,该模型的成本比Haiku 4.5低约75%。对于提示词不超过100,000 token的请求,价格最多下降90%,Anthropic称此类请求约占以往所有Haiku请求的90%。超过100,000 token的提示词价格则高出五倍。

每1百万token价格 Haiku 5.5(提示词不超过/超过100k) Haiku 4.5 Sonnet 5.5
缓存读取 $0.01 / $0.05 $0.10 $0.10
缓存写入 $0.125 / $0.625 $1.25 $2.50
输入token $0.10 / $0.50 $1.00 $2.00
输出token $0.50 / $2.50 $5.00 $10.00

Anthropic指出,Haiku 5.5使用了更新后的分词器,每任务消耗的token略多于前代。同样的情况 也发生在Opus 4.x系列模型上,仅分词器变更就导致token使用量增加了约30%。实际节省很可能低于每token价格所显示的水平。

基准测试显示较Haiku 4.5大幅跃升

Haiku 5.5在知识基准GDPval-AA v2.1上得分为1,620,是前代735分的两倍多。在Humanity's Last Exam上,无工具时得分45.9%,有工具时得分57.4%,而此前分别为10.2%和18.7%。广告

最大幅度的跃升出现在 计算机使用领域,即模型自主操作计算机。由于计算机使用会消耗大量token,像Haiku 5.5这样廉价快速的模型是天然之选。它在OSWorld-2.1上得分72.4%,而此前为15.7%。在代理式编码基准Terminal-Bench 4.0上,它达到39.2%,而Haiku 4.5得分为零。

Anthropic还列出了OpenAI的廉价模型 GPT-6 Luna 作为对比,Haiku 5.5 在所有测试类别中均处于领先地位。然而,Sonnet 5.5 的参考分数表明,Haiku 5.5 仍远远落后于 Anthropic 更大的模型。

Haiku 5.5 Haiku 4.5 GPT-6 Luna Sonnet 5.5
知识工作 / GDPval-AA v2.1 1,620 735 1,437 1,840
知识工作 / AA-Briefcase v1.1 1,578 614 1,336 1824
计算机使用 / OSWorld 2.1 72.4%(离线子集) 15.7%(离线子集) 48.9%(离线子集) 83.9%(离线子集)
多学科推理 / Humanity's Last Exam 45.9%(无工具) 10.2%(无工具) — 56.9%(无工具)
57.4%(有工具) 18.7%(有工具) — 64.5%(有工具)
智能体编程 / Terminal-Bench 4.0 39.2% 0.0% 16.4% 70.6%
智能体编程 / FrontierCode 1.1 (Main) 46.4% — 42.4% 52.1%(Xhigh)
视觉推理 / Chartography 46.4%(无工具) 6.4%(无工具) 29.1%(无工具) 61.6%(无工具)

首款 Haiku 模型让用户用成本换取性能

Haiku 5.5 是首款具备可调推理级别的 Haiku 级模型,让用户可以在成本与质量之间取得平衡。Anthropic 表示,该模型最适用于范围狭窄的任务,例如压缩、摘要或子智能体工作。对于复杂的智能体编程,Sonnet 5.5 和 Opus 5.5 仍是更好的选择。

网络安全防护措施比前代模型更严格,但允许的防御性任务范围比 Sonnet 5.5 更广,部分原因是该模型整体能力较弱。渗透测试仍然被禁止。有更广泛需求的组织可以申请 Anthropic 的生命科学和网络安全验证计划。广告

Haiku 5.5 现已在所有平台可用,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。

Sonnet 5.5 也变得更便宜,Anthropic 还发放 API 额度

随 Haiku 发布,Anthropic 将 Sonnet 5.5 的缓存读取成本降低了 50%,从每百万 token 0.20 美元降至 0.10 美元。公司表示,这应能将大多数智能体任务的成本降低约 20%。此举几乎可以肯定是对 OpenAI 新的 GPT-6.1 系列的回应,表明 AI 价格战正以前所未有的激烈程度展开。

Anthropic 还推出了每月 API 额度。Max-5x 订阅者可获得 100 美元,Max-20x 订阅者可获得 200 美元,Team 订阅者每月最高可获得 500 美元。用户可以通过 API 使用这些额度来试验工具、应用和智能体。

公司还在更新其 Python 和 TypeScript SDK,添加对以下功能的 beta 支持: 计算机使用和浏览器使用.

没有炒作的 AI 新闻 – 由人工精心筛选

订阅 THE DECODER,即可享受无广告阅读、每周 AI 新闻通讯、每年六期独家“AI Radar”前沿报告、完整档案访问权限以及评论区访问权限。

来源: Anthropic
原始出处

The Decoder

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准