Anthropic 发布 Claude Haiku 5.5,价格对齐 GPT-6 Luna
Claude Haiku 5.5
Anthropic 发布新的快速低成本模型 Claude Haiku 5.5,Simon Willison 实测称其在 100,000 tokens 内价格为 $0.10/$0.50,与 GPT-6 Luna 相同。
作者实测了价格、tokenizer 和推理档位,便于比较 Claude Haiku 5.5 与 GPT-6 Luna 的成本差异。
2026 年 10 月 7 日
正如之前承诺的,这是 Anthropic 新推出的快速、低成本模型:Introducing Claude Haiku 5.5。
上一代 Haiku,也就是 4.5,已经明显显出老态。它差不多一年前发布,定价为每百万输入 $1、每百万输出 $5——即便在当时也算相对昂贵,而且是 OpenAI 上个月发布的 GPT-6 Luna 价格的整整 10 倍。
新的 Haiku 与 GPT-6 Luna 价格完全一致——$0.10/$0.50——适用于最多 100,000 个 token。超过 100,000 个 token 后,价格上涨 5 倍至 $0.50/$2.50。Luna 本身在 272,000 个 token 时也会涨价,但只涨到 $0.20/$0.75。
Haiku 5.5 还使用了一种新的、不那么宽松的 tokenizer。我的 Claude Token Counter 工具显示,与 Haiku 4.5 相比,同一个长提示在 Haiku 5.5 上大约会使用 1.25 倍的 token,因此这里存在一个隐藏的涨价。
如果你的工作负载能控制在 100,000 个 token 以内,Haiku 的价格与 Luna 相同,并且报告的基准测试分数更高。超过 100,000 个 token 时,Luna 看起来划算得多。
llm-anthropic 的最新版本终于修复了这个问题,因此我不再需要为每个新模型都发布该插件的新版本。我是这样测试这个新模型的:
llm install -U llm-anthropic
llm anthropic refresh
llm -m claude-haiku-5.5 "Generate an SVG of a pelican riding a bicycle" -o thinking_effort low
鹈鹕
这里是低、中、高、xhigh 和 max 档位的鹈鹕。新的 Haiku 不允许你关闭推理,并且默认使用 medium。在 low 以上的所有档位里,我都得到了不错的自行车车架。低努力档位的鹈鹕花费 0.0936 美分,用时 7 秒。
这个 max 努力档位的鹈鹕(带有一段推理轨迹,开头是“This is the classic pelican-on-bicycle SVG test...”)生成用了 5 分 9 秒,但仍然只花了我 3.3826 美分:

(由于推理轨迹表现出对该基准测试的知晓,这里是生成一个穿渔网袜的犰狳在火星上乱穿马路的 SVG(xhigh 档),以及同一提示在其他一些近期模型上的结果。相关背景。)
作为对比,这是我一年前从 Haiku 4.5 得到的鹈鹕(花费 0.7583 美分——Haiku 4.5 不支持推理等级)。它画鹈鹕画得糟透了:

以及面向订阅者的慷慨 API 额度方案
除了 Haiku 5.5,Anthropic 今天还宣布将 Sonnet 5.5 的缓存读取价格减半。他们还为订阅计划增加了 API 额度:
其次,本周,我们将向所有 Max 和 Team 订阅者推出新的每月 API 额度,可用于 Claude Platform。Max 5x 用户每月将获得 $100 额度,Max 20x 用户将获得 $200,Team 订阅者将获得最多 $500,并在其用户之间共享。
领取方式相当简单:前往设置 -> 账单,并选择每月应享受这些额度的 API 组织:

API 额度与订阅本身的费用完全相同。这真的很慷慨——它让订阅者使用 API 变得容易得多。Anthropic 还允许你为 API 关闭自动充值,其结果是“余额用完时 API 请求将停止”——如果你打算用完这些 API 额度,同时又不想承担令人不快的账单惊喜风险,这正是你想要的。
请注意,每月额度不会滚存——不用就作废。
OpenAI 仍然允许你将 Codex 订阅用于个人 API 使用,这对重度 API 用户来说更划算。这个新的点数方案至少在一定程度上弥合了这一差距。
来源:Simon Willison · simonwillison.net