The Decoder · 2026/10/7 18:49:23
Anthropic 发布 Claude Haiku 5.5:输入成本降 90% 并同步下调 Sonnet 定价
Anthropic 推出新一代小模型 Claude Haiku 5.5,针对高吞吐任务将平均成本降低 75%,短提示词场景下输入价格降幅高达 90%。同时,公司大幅下调旗舰级 Sonnet 5.5 的 API 定价,并更新 SDK 以支持计算机与浏览器操作功能。
报道全文原始报道全文
本文目录3 个章节
Anthropic 发布了 Claude Haiku 5.5,这是该公司迄今为止速度最快、成本最低的小型模型。基准测试结果显示,其性能较前代产品有大幅提升,同时 Anthropic 还下调了 Sonnet 5.5 的价格。
据 Anthropic 介绍,Haiku 5.5 专为高吞吐量、对成本敏感的任务设计,例如摘要生成、数据库查询、分类以及实时客户支持。平均而言,该模型的成本比 Haiku 4.5 低约 75%。对于提示词长度不超过 100,000 个 token 的请求(Anthropic 称此类请求约占此前所有 Haiku 请求的 90%),价格降幅高达 90%。而超过 100,000 个 token 的提示词,其费用则是标准价格的五倍。
| 每百万 token 价格 | Haiku 5.5(提示词 ≤ / > 100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 缓存读取 (Cache Reads) | 0.05 | $0.10 | $0.10 |
| 缓存写入 (Cache Writes) | 0.625 | $1.25 | $2.50 |
| 输入 Token (Input Tokens) | 0.50 | $1.00 | $2.00 |
| 输出 Token (Output tokens) | 2.50 | $5.00 | $10.00 |
Anthropic 指出,Haiku 5.5 采用了更新后的 tokenizer,导致每个任务消耗的 token 数量略高于前代模型。Opus 4.x 系列模型也曾出现类似情况,仅因 tokenizer 变更就导致 token 使用量增加了约 30%。因此,实际节省的费用可能低于按单 token 价格计算得出的数值。
基准测试显示相比 Haiku 4.5 有巨大飞跃
在知识基准测试 GDPval-AA v2.1 中,Haiku 5.5 得分 1,620,是其前代产品得分 735 的两倍多。在“人类最后考试”(Humanity's Last Exam)中,其在无工具辅助下的得分为 45.9%,有工具辅助下为 57.4%,较之前的 10.2% 和 18.7% 有显著提升。
最大的提升体现在 计算机操作能力 上,即模型自主操控计算机的能力。由于计算机操作会消耗大量 token,像 Haiku 5.5 这样廉价且快速的模型显得尤为合适。它在 OSWorld-2.1 上的得分达到 72.4%,远高于之前的 15.7%。在智能体编程基准测试 Terminal-Bench 4.0 中,它达到了 39.2% 的成绩,而 Haiku 4.5 在此项测试中得分为零。
Anthropic 还将 OpenAI 的平价模型 GPT-6 Luna 列为对比对象,Haiku 5.5 在所有测试类别中均领先。然而,Sonnet 5.5 的参考分数表明,Haiku 5.5 仍明显落后于 Anthropic 的更大规模模型。
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 | |
|---|---|---|---|---|
| 知识工作 / GDPval-AA v2.1 | 1,620 | 735 | 1,437 | 1,840 |
| 知识工作 / AA-Briefcase v1.1 | 1,578 | 614 | 1,336 | 1824 |
| 计算机使用 / OSWorld 2.1 | 72.4%(离线子集) | 15.7%(离线子集) | 48.9%(离线子集) | 83.9%(离线子集) |
| 多学科推理 / Humanity's Last Exam | 45.9%(无工具) | 10.2%(无工具) | — | 56.9%(无工具) |
| 57.4%(有工具) | 18.7%(有工具) | — | 64.5%(有工具) | |
| 智能体编程 / Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| 智能体编程 / FrontierCode 1.1(主分支) | 46.4% | — | 42.4% | 52.1%(Xhigh) |
| 视觉推理 / Chartography | 46.4%(无工具) | 6.4%(无工具) | 29.1%(无工具) | 61.6%(无工具) |
首款 Haiku 模型允许用户在成本与性能之间权衡
Haiku 5.5 是首款具备可调推理级别的 Haiku 级模型,让用户能够在成本和质量之间取得平衡。Anthropic 表示,该模型最适合范围狭窄的任务,如上下文压缩、摘要生成或子智能体工作。对于复杂的智能体编程任务,Sonnet 5.5 和 Opus 5.5 仍是更佳选择。
其网络安全防护措施比前代更严格,但相比 Sonnet 5.5 允许更广泛的防御性任务,部分原因在于该模型整体能力较弱。渗透测试仍然被禁止。需求更广泛的组织可以申请加入 Anthropic 面向生命科学和网络安全领域的验证计划。
Haiku 5.5 现已在所有平台上线,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。
Sonnet 5.5 也降价了,且 Anthropic 发放 API 额度
随着 Haiku 的发布,Anthropic 将 Sonnet 5.5 的缓存读取成本降低了 50%,从每百万 token 0.20 美元降至 0.10 美元。该公司表示,此举预计将使大多数 agentic 任务的成本降低约 20%。这一举措几乎可以肯定是对 OpenAI 全新 GPT-6.1 系列 的回应,表明 AI 价格战正以前所未有的激烈程度展开。
Anthropic 还推出了每月 API 额度。Max-5x 订阅用户可获得 100 美元,Max-20x 订阅用户可获得 200 美元,Team 订阅用户每月最多可获得 500 美元。用户可以使用这些额度通过 API 试验各种工具、应用和 agent。
此外,该公司正在更新其 Python 和 TypeScript SDK,新增了对 computer use 和 browser use 的 beta 支持。