Arena · X更新于

@AnthropicAI 的 Claude Haiku 5.5 (High) 真实世界结果出炉了。

Arena公布Anthropic的Claude Haiku 5.5(High)实测成绩,在Code Arena: WebDev以1587分首秀排第30,价格与GPT‑6 Luna持平。该结果来自第三方榜单,模型位于Pareto前沿之外。

配图来源 · Arena · X

@AnthropicAI 的 Claude Haiku 5.5 (High) 真实世界结果出炉了。

该版本在 Code Arena: WebDev 中以 1587 分首次亮相,排名第 30 位,虽然略微偏离 Pareto 前沿,但仍具备出色的成本效率。它的价格与 GPT‑6 Luna 相同,为每 1M 输入/输出 token 0.10/0.50 美元,同时得分高出 6 分。

与其他 Claude 模型相比,Haiku 5.5 具有:
- 成本比 Haiku 4.5 低 90%,分数 +257 分
- 成本比 Sonnet 5.5 (High) 低 95%,分数 -128 分
- 成本比 Opus 5 (High) 低 98%,分数 -70 分
- 成本比 Fable 5.1 (Max) 低 99%,分数 -157 分

祝贺 @AnthropicAI 团队发布此版本!

原始出处

Arena · X

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准