Anthropic 发布 Claude Haiku 5.5,并下调 Haiku 与 Sonnet 价格
Claude Haiku 5.5 arrives with massive price cuts proving the AI pricing arms race is far from over
Anthropic 发布 Claude Haiku 5.5,称其是公司迄今最快、最便宜的小模型,并同时下调 Sonnet 5.5 价格。Haiku 5.5 面向摘要、数据库查询、分类和实时客服等高量、成本敏感任务,100,000 tokens 以内提示词价格最高下降 90%,但新版 tokenizer 可能让实际节省小于单价降幅。
文章集中列出价格、基准和可用平台,可用于比较 Haiku 5.5 与同级模型的成本边界。
Anthropic 发布了 Claude Haiku 5.5,这是该公司迄今为止最快、最实惠的小型模型。基准测试结果显示,其性能较前代有大幅提升,Anthropic 还在下调 Sonnet 5.5 的价格。
Anthropic 表示,Haiku 5.5 专为摘要、数据库查询、分类和实时客户支持等高吞吐量、成本敏感型任务而设计。平均而言,该模型的成本比 Haiku 4.5 低约 75%。对于提示词最多 100,000 个 token 的请求,Anthropic 称这类请求约占此前所有 Haiku 请求的 90%,价格最高下降 90%。超过 100,000 个 token 的提示词成本则高出五倍。
| 每 100 万个 token 的价格 | Haiku 5.5(提示词不超过 / 超过 100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 缓存读取 | $0.01 / $0.05 | $0.10 | $0.10 |
| 缓存写入 | $0.125 / $0.625 | $1.25 | $2.50 |
| 输入 token | $0.10 / $0.50 | $1.00 | $2.00 |
| 输出 token | $0.50 / $2.50 | $5.00 | $10.00 |
Anthropic 指出,Haiku 5.5 使用了更新的分词器,每项任务消耗的 token 略多于其前代。Opus 4.x 模型也出现过同样情况,仅分词器变更就使 token 使用量增加了约 30%。实际节省可能小于按每 token 价格所显示的幅度。
基准测试显示相较 Haiku 4.5 有巨大飞跃
Haiku 5.5 在知识基准 GDPval-AA v2.1 上得分 1,620,是其前代 735 分的两倍多。在 Humanity's Last Exam 上,它在不使用工具时达到 45.9%,使用工具时达到 57.4%,高于此前的 10.2% 和 18.7%。
最大提升出现在计算机使用方面,即模型自行操作计算机。由于计算机使用会消耗大量 token,Haiku 5.5 这样便宜且快速的模型自然很适合。它在 OSWorld-2.1 上得分 72.4%,高于此前的 15.7%。在智能体编码基准 Terminal-Bench 4.0 上,它达到 39.2%,而 Haiku 4.5 得分为零。
Anthropic 还列出了 OpenAI 的预算型模型 GPT-6 Luna 作为对比,Haiku 5.5 在所有测试类别中均领先。不过,Sonnet 5.5 的参考分数显示,Haiku 5.5 仍明显落后于 Anthropic 的更大模型。
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 | |
|---|---|---|---|---|
| 知识工作 / GDPval-AA v2.1 | 1,620 | 735 | 1,437 | 1,840 |
| 知识工作 / AA-Briefcase v1.1 | 1,578 | 614 | 1,336 | 1824 |
| 计算机使用 / OSWorld 2.1 | 72.4%(离线子集) | 15.7%(离线子集) | 48.9%(离线子集) | 83.9%(离线子集) |
| 多学科推理 / Humanity's Last Exam | 45.9%(无工具) | 10.2%(无工具) | — | 56.9%(无工具) |
| 57.4%(使用工具) | 18.7%(使用工具) | — | 64.5%(使用工具) | |
| 智能体编码 / Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| 智能体编码 / FrontierCode 1.1(Main) | 46.4% | — | 42.4% | 52.1%(Xhigh) |
| 视觉推理 / Chartography | 46.4%(无工具) | 6.4%(无工具) | 29.1%(无工具) | 61.6%(无工具) |
首个 Haiku 模型允许用户在成本与性能之间进行权衡
Haiku 5.5 是首个具备可调推理级别的 Haiku 级模型,让用户能够在成本和质量之间取得平衡。Anthropic 表示,该模型最适合范围明确的任务,例如压缩、摘要或子智能体工作。对于复杂的智能体编码,Sonnet 5.5 和 Opus 5.5 仍是更好的选择。
网络安全防护措施比前代更严格,但相比 Sonnet 5.5 允许更广泛的防御性任务,部分原因是该模型整体能力较弱。渗透测试仍被阻止。有更广泛需求的组织可以申请 Anthropic 的生命科学与网络安全验证计划。
Haiku 5.5 现已在所有平台上线,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。
Sonnet 5.5 也降价,Anthropic 发放 API 额度
在发布 Haiku 的同时,Anthropic 将 Sonnet 5.5 的缓存读取成本下调 50%,从每百万 token $0.20 降至 $0.10。该公司表示,这应能让大多数智能体任务的成本降低约 20%。此举几乎可以肯定是对 OpenAI 新 GPT-6.1 系列的回应,表明 AI 价格战比以往任何时候都更加激烈。
Anthropic 还在推出每月 API 额度。Max-5x 订阅用户可获得 $100,Max-20x 订阅用户可获得 $200,Team 订阅用户每月最多可获得 $500。用户可以使用这些额度通过 API 试用工具、应用和智能体。
该公司还在更新其 Python 和 TypeScript SDK,加入对计算机使用和浏览器使用的 beta 支持。
没有炒作的 AI 新闻——由人工精选
订阅 THE DECODER,即可享受无广告阅读、每周 AI 新闻简报、我们每年六期的独家“AI Radar”前沿报告、完整档案访问权限,以及访问我们的评论区。
来源:The Decoder · the-decoder.com