@AnthropicAI 的 Claude Haiku 5.5 (High) 真实世界结果出炉了。
该版本在 Code Arena: WebDev 中以 1587 分首次亮相,排名第 30,略低于帕累托前沿,同时仍提供出色的成本效益。它的价格与 GPT‑6 Luna 相同,为每 1M 输入/输出 token 0.10/0.50 美元,而得分高出 6 分。
与其他 Claude 模型相比,Haiku 5.5 具有:
- 比 Haiku 4.5 成本低 90%,得分 +257 分
- 比 Sonnet 5.5 (High) 成本低 95%,得分 -128 分
- 比 Opus 5 (High) 成本低 98%,得分 -70 分
- 比 Fable 5.1 (Max) 成本低 99%,得分 -157 分
祝贺 @AnthropicAI 团队的这次发布!