Simon Willison 博客 · 2026/10/7 20:56:21
Anthropic 发布 Claude Haiku 5.5:定价对齐 GPT-6 Luna 但新分词器致隐性成本上升
Anthropic 正式推出新一代轻量级模型 Claude Haiku 5.5,其基础定价($0.10/$0.50)直接对标 OpenAI 的 GPT-6 Luna,旨在解决旧版 Haiku 4.5 价格过高且性能落后的问题。然而,新模型采用了更保守的分词器,导致相同文本的 Token 消耗量增加约 25%,从而在长上下文场景下引发隐性成本上涨。这一策略标志着小模型竞争从单纯的价格战转向对推理效率与计费机制的深度博弈。
报道全文原始报道全文
本文目录2 个章节
正如之前承诺的那样,Anthropic 推出了其新款快速、低成本模型:Claude Haiku 5.5 正式发布。
上一代 Haiku(4.5)显然已经显得过时。它发布于将近一年前,定价为每百万输入 token 1 美元、每百万输出 token 5 美元——即便在当时也相对昂贵,更是 OpenAI 上个月发布的 GPT-6 Luna 价格的整整 10 倍。
新款 Haiku 的价格与 GPT-6 Luna 完全一致——在 100,000 token 以内为 0.50。超过 100,000 token 后,价格上调 5 倍至 2.50。Luna 本身在 272,000 token 处也有价格上调,但仅升至 0.75。
Haiku 5.5 还采用了一种新的、效率较低的 tokenizer。我的 Claude Token Counter 工具显示,同样的长提示词在 Haiku 5.5 下使用的 token 数量大约是 Haiku 4.5 的 1.25 倍,因此这里存在一个隐性的价格上涨。
如果你的工作负载在 100,000 token 以内,Haiku 的价格与 Luna 相同,且报告的 benchmark 分数更高。一旦超过 100,000 token,Luna 看起来就是更划算的选择。
llm-anthropic 的最新版本终于修复了这个问题,使得我不必为每个新模型都发布该插件的新版本。我这样测试了新模型:
llm install -U llm-anthropic
llm anthropic refresh
llm -m claude-haiku-5.5 "Generate an SVG of a pelican riding a bicycle" -o thinking_effort low鹈鹕
这里是低、中、高、超高和最大推理努力程度下的鹈鹕图像。新版 Haiku 不允许禁用推理功能,默认设置为 medium。除了 low 之外,所有其他设置都生成了不错的自行车车架。低努力程度的鹈鹕花费了 0.0936 美分,耗时 7 秒。
这个 max 努力程度的鹈鹕生成耗时 5 分 9 秒,但成本仍然仅为 3.3826 美分:

作为对比,这是一年前我用 Haiku 4.5 生成的鹈鹕。它在绘制鹈鹕方面非常糟糕:

并为订阅用户提供慷慨的 API 积分方案
除了 Haiku 5.5,Anthropic 今天宣布将 Sonnet 5.5 的缓存读取价格减半。他们还为订阅计划添加了 API 积分:
其次,本周我们将为所有 Max 和 Team 订阅用户推出每月新的 API 积分,用于 Claude Platform。Max 5x 用户每月将获得 100 美元积分,Max 20x 用户将获得 200 美元,Team 订阅用户最多可获得 500 美元,这些积分在其用户间共享。
领取过程非常简单:前往 Settings -> Billing,选择每月应享受积分的 API 组织即可:
API 积分的金额与订阅费用完全一致。这确实非常慷慨——它让订阅用户使用 API 变得更加容易。Anthropic 还允许你禁用 API 的自动充值功能,其后果是“当余额耗尽时,API 请求将停止”——如果你打算用完这些 API 积分而不必担心令人不快的账单意外,这正是你想要的效果。
请注意,每月积分不会结转——要么使用,要么作废。
OpenAI 仍然允许你将 Codex 订阅用于个人 API 使用,对于重度 API 用户来说,这实际上是一笔更划算的交易。这一新的积分方案至少在一定程度上弥补了这种差异。
标签:ai, generative-ai, llms, anthropic, claude, llm-pricing, pelican-riding-a-bicycle, llm-release