Today for AI

The Decoder · 2026/10/7 18:49:23

Anthropic 发布 Claude Haiku 5.5:输入成本降 90% 并同步下调 Sonnet 定价

出处作者 / 发布主体:Matthias Bastian原标题:Claude Haiku 5.5 arrives with massive price cuts proving the AI pricing arms race is far from over
78AI 研判分
核心综述

Anthropic 推出新一代小模型 Claude Haiku 5.5,针对高吞吐任务将平均成本降低 75%,短提示词场景下输入价格降幅高达 90%。同时,公司大幅下调旗舰级 Sonnet 5.5 的 API 定价,并更新 SDK 以支持计算机与浏览器操作功能。

报道全文原始报道全文

本文目录3 个章节

Anthropic 发布了 Claude Haiku 5.5,这是该公司迄今为止速度最快、成本最低的小型模型。基准测试结果显示,其性能较前代产品有大幅提升,同时 Anthropic 还下调了 Sonnet 5.5 的价格。

据 Anthropic 介绍,Haiku 5.5 专为高吞吐量、对成本敏感的任务设计,例如摘要生成、数据库查询、分类以及实时客户支持。平均而言,该模型的成本比 Haiku 4.5 低约 75%。对于提示词长度不超过 100,000 个 token 的请求(Anthropic 称此类请求约占此前所有 Haiku 请求的 90%),价格降幅高达 90%。而超过 100,000 个 token 的提示词,其费用则是标准价格的五倍。

每百万 token 价格Haiku 5.5(提示词 ≤ / > 100k)Haiku 4.5Sonnet 5.5
缓存读取 (Cache Reads)0.01/0.01 / 0.05$0.10$0.10
缓存写入 (Cache Writes)0.125/0.125 / 0.625$1.25$2.50
输入 Token (Input Tokens)0.10/0.10 / 0.50$1.00$2.00
输出 Token (Output tokens)0.50/0.50 / 2.50$5.00$10.00

Anthropic 指出,Haiku 5.5 采用了更新后的 tokenizer,导致每个任务消耗的 token 数量略高于前代模型。Opus 4.x 系列模型也曾出现类似情况,仅因 tokenizer 变更就导致 token 使用量增加了约 30%。因此,实际节省的费用可能低于按单 token 价格计算得出的数值。

基准测试显示相比 Haiku 4.5 有巨大飞跃

在知识基准测试 GDPval-AA v2.1 中,Haiku 5.5 得分 1,620,是其前代产品得分 735 的两倍多。在“人类最后考试”(Humanity's Last Exam)中,其在无工具辅助下的得分为 45.9%,有工具辅助下为 57.4%,较之前的 10.2% 和 18.7% 有显著提升。

最大的提升体现在 计算机操作能力 上,即模型自主操控计算机的能力。由于计算机操作会消耗大量 token,像 Haiku 5.5 这样廉价且快速的模型显得尤为合适。它在 OSWorld-2.1 上的得分达到 72.4%,远高于之前的 15.7%。在智能体编程基准测试 Terminal-Bench 4.0 中,它达到了 39.2% 的成绩,而 Haiku 4.5 在此项测试中得分为零。

Anthropic 还将 OpenAI 的平价模型 GPT-6 Luna 列为对比对象,Haiku 5.5 在所有测试类别中均领先。然而,Sonnet 5.5 的参考分数表明,Haiku 5.5 仍明显落后于 Anthropic 的更大规模模型。

Haiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5
知识工作 / GDPval-AA v2.11,6207351,4371,840
知识工作 / AA-Briefcase v1.11,5786141,3361824
计算机使用 / OSWorld 2.172.4%(离线子集)15.7%(离线子集)48.9%(离线子集)83.9%(离线子集)
多学科推理 / Humanity's Last Exam45.9%(无工具)10.2%(无工具)—56.9%(无工具)
57.4%(有工具)18.7%(有工具)—64.5%(有工具)
智能体编程 / Terminal-Bench 4.039.2%0.0%16.4%70.6%
智能体编程 / FrontierCode 1.1(主分支)46.4%—42.4%52.1%(Xhigh)
视觉推理 / Chartography46.4%(无工具)6.4%(无工具)29.1%(无工具)61.6%(无工具)

首款 Haiku 模型允许用户在成本与性能之间权衡

Haiku 5.5 是首款具备可调推理级别的 Haiku 级模型,让用户能够在成本和质量之间取得平衡。Anthropic 表示,该模型最适合范围狭窄的任务,如上下文压缩、摘要生成或子智能体工作。对于复杂的智能体编程任务,Sonnet 5.5 和 Opus 5.5 仍是更佳选择。

其网络安全防护措施比前代更严格,但相比 Sonnet 5.5 允许更广泛的防御性任务,部分原因在于该模型整体能力较弱。渗透测试仍然被禁止。需求更广泛的组织可以申请加入 Anthropic 面向生命科学和网络安全领域的验证计划。

Haiku 5.5 现已在所有平台上线,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。

Sonnet 5.5 也降价了,且 Anthropic 发放 API 额度

随着 Haiku 的发布,Anthropic 将 Sonnet 5.5 的缓存读取成本降低了 50%,从每百万 token 0.20 美元降至 0.10 美元。该公司表示,此举预计将使大多数 agentic 任务的成本降低约 20%。这一举措几乎可以肯定是对 OpenAI 全新 GPT-6.1 系列 的回应,表明 AI 价格战正以前所未有的激烈程度展开。

Anthropic 还推出了每月 API 额度。Max-5x 订阅用户可获得 100 美元,Max-20x 订阅用户可获得 200 美元,Team 订阅用户每月最多可获得 500 美元。用户可以使用这些额度通过 API 试验各种工具、应用和 agent。

此外,该公司正在更新其 Python 和 TypeScript SDK,新增了对 computer use 和 browser use 的 beta 支持。