Claude Haiku 5.5 发布:低价高速模型与订阅 API 额度

Simon Willison2 天前

Anthropic 发布了新的快速、低成本模型 Claude Haiku 5.5。与上一代 Haiku 4.5 相比,新模型在定价、推理能力和订阅 API 额度方面都有明显变化。

定价:100K token 内更有竞争力

上一代 Claude Haiku 4.5 发布于约一年前,当时价格为:

  • 输入:1 美元 / 百万 token
  • 输出:5 美元 / 百万 token

这个价格即使在当时也不算便宜,并且是 OpenAI 上月发布的 GPT-6 Luna 的 10 倍。

Claude Haiku 5.5 在 100,000 token 以内 的价格与 GPT-6 Luna 完全一致:

  • 输入:0.10 美元 / 百万 token
  • 输出:0.50 美元 / 百万 token

但超过 100,000 token 后,Haiku 5.5 的价格会上涨 5 倍:

  • 输入:0.50 美元 / 百万 token
  • 输出:2.50 美元 / 百万 token

相比之下,GPT-6 Luna 的涨价阈值在 272,000 token,涨价后为:

  • 输入:0.20 美元 / 百万 token
  • 输出:0.75 美元 / 百万 token

因此,如果工作负载能控制在 100,000 token 以内,Haiku 5.5 的价格与 Luna 相同,并且官方基准分数更高;但如果经常超过 100,000 token,Luna 的成本看起来更有优势。

Tokenizer 变化带来“隐性涨价”

Haiku 5.5 使用了新的 tokenizer,但它并不如上一代“慷慨”。同一段较长提示词,在 Haiku 5.5 中消耗的 token 数大约是 Haiku 4.5 的 1.25 倍。

这意味着即使标价下降,实际使用成本也需要结合 tokenizer 变化重新估算。对于长上下文应用,这一点尤其值得关注。

推理模式:无法关闭,默认 medium

在测试中,Haiku 5.5 不允许关闭 reasoning,并且默认推理强度为 medium。

测试命令示例:

llm install -U llm-anthropic
llm anthropic refresh
llm -m claude-haiku-5.5 "Generate an SVG of a pelican riding a bicycle" -o thinking_effort low

使用“鹈鹕骑自行车”的 SVG 生成任务进行测试时,不同推理强度包括:

  • low
  • medium
  • high
  • xhigh
  • max

测试结果显示,除 low 之外,其他推理强度都生成了较好的自行车车架。

其中:

  • low 推理强度耗时 7 秒,成本约 0.0936 美分
  • max 推理强度耗时 5 分 9 秒,成本约 3.3826 美分

与一年前的 Haiku 4.5 相比,Haiku 5.5 在该绘图任务上的表现有明显提升。

Sonnet 5.5 缓存读取价格下调

除了 Haiku 5.5,Anthropic 还宣布将 Sonnet 5.5 的缓存读取价格减半。

这对大量使用上下文缓存的应用有直接影响,尤其是长提示词、多轮对话、代码分析等场景。

Max 和 Team 订阅加入每月 API 额度

Anthropic 还为订阅计划加入了新的每月 API credit:

  • Max 5x 用户:每月 100 美元 API 额度
  • Max 20x 用户:每月 200 美元 API 额度
  • Team 用户:最高每月 500 美元 API 额度,由团队成员共享

这些 API 额度与订阅费用金额相匹配。用户可以在设置的 Billing 页面中绑定 API organization,以便每月领取额度。

Anthropic 也允许用户关闭 API 自动充值。关闭后,当余额耗尽时,API 请求会停止。这对于只想用完订阅附带额度、避免意外账单的用户比较有用。

需要注意的是,这些每月 API 额度 不会滚存,当月不用就会失效。

与 OpenAI 订阅的差异

OpenAI 仍允许用户将 Codex 订阅用于个人 API 使用。对于重度 API 用户来说,这种模式可能仍然更划算。

Anthropic 新增的 API 额度机制在一定程度上缩小了这一差距,也让 Claude 订阅用户更容易开始使用 API。

评论

请登录后发表观点

暂无数据