Anthropic 发布 Claude Haiku 5.5,低价档与 GPT-6 Luna 持平并附带订阅 API 额度
Claude Haiku 5.5
Anthropic 发布新快速低价模型 Claude Haiku 5.5,定价在 100,000 tokens 内与 OpenAI GPT-6 Luna 持平($0.10/$0.50 per million),超出后涨 5 倍至 $0.50/$2.50,同时新分词器使同样长提示词多用约 1.25x tokens。
2026年10月7日
如之前所承诺的,Anthropic 的新款快速低成本模型来了:Claude Haiku 5.5 发布。
上一代 Haiku 4.5 已经明显显老了。它发布于近一年前,定价为输入 $1/百万 token、输出 $5/百万 token——即便在当时也相对昂贵,而且是 OpenAI 上个月发布的 GPT-6 Luna 价格的整整 10 倍。
新的 Haiku 在 100,000 token 以内的价格与 GPT-6 Luna 完全一致——$0.10/$0.50。超过 100,000 token 后价格上涨 5 倍至 $0.50/$2.50。Luna 本身在 272,000 token 处也有涨价,但只涨到 $0.20/$0.75。
Haiku 5.5 还使用了一个新的、不那么划算的分词器。我的 Claude Token Counter 工具显示,同一段长 prompt 在 Haiku 5.5 上消耗的 token 数约为 Haiku 4.5 的 1.25 倍,所以这里存在一个隐性的涨价。
如果你的工作负载在 100,000 token 以内,Haiku 与 Luna 价格相同且报告的基准测试分数更高。超过 100,000 token,Luna 看起来就划算得多。
最新发布的 llm-anthropic 终于修复了这个问题,我不必再为每个新模型发布新版本的插件。我这样测试了新模型:
llm install -U llm-anthropic
llm anthropic refresh
llm -m claude-haiku-5.5 "Generate an SVG of a pelican riding a bicycle" -o thinking_effort low
鹈鹕
这里有low、medium、high、xhigh 和 max 推理级别的鹈鹕。新的 Haiku 不允许禁用推理,默认为 medium。除 low 之外,所有级别我都得到了不错的自行车架。low 推理级别的鹈鹕花费 0.0936 美分,耗时 7 秒。
这个 max 推理级别的鹈鹕花了 5 分 9 秒才生成完成,但仍然只花费了我 3.3826 美分:

作为对比,这是一年前我用 Haiku 4.5 得到的鹈鹕(花费 0.7583 美分——Haiku 4.5 不支持推理级别)。它画鹈鹕很烂:

以及面向订阅者的慷慨 API 额度计划
除了 Haiku 5.5,Anthropic 今天还宣布将 Sonnet 5.5 的缓存读取价格减半。他们还在订阅计划中加入了 API 额度:
其次,本周我们将向所有 Max 和 Team 订阅者推出新的每月 API 额度,可在 Claude 平台上使用。Max 5x 用户每月将获得 $100 额度,Max 20x 用户将获得 $200,Team 订阅者将获得最高 $500,在其用户之间共享。
领取过程非常简单:前往 Settings -> Billing,选择每个月应享受额度的 API 组织即可:

这些 API 额度正好与订阅本身的价格相当。这实在非常慷慨——它让订阅者使用 API 变得容易得多。Anthropic 还允许你关闭 API 的自动充值,这样做的后果是“余额用尽时 API 请求将停止”——如果你计划用完这些 API 额度而不想遭遇糟糕的账单意外,这正是你想要的。
请注意,每月额度不会结转——用掉或失去。
OpenAI 仍然允许你将 Codex 订阅用于个人 API 用途,这对重度 API 用户来说更划算。这个新的额度计划至少在一定程度上弥补了这一差距。
来源:Simon Willison · simonwillison.net