Anthropic 发布 Claude Haiku 5.5,平均降价约 75% 并下调 Sonnet 5.5 缓存读取价格
Claude Haiku 5.5 arrives with massive price cuts proving the AI pricing arms race is far from over
Anthropic 发布 Claude Haiku 5.5,是其最快、最便宜的小模型,平均比 Haiku 4.5 便宜约 75%,10 万 token 以内的提示词降价最多达 90%,更长提示词价格高 5 倍。
同一新闻,精选展示《Claude Haiku 5.5 上线 Claude Platform 和 Claude Code,运行成本平均比 Haiku 4.5 低约 75%》
Anthropic 发布了 Claude Haiku 5.5,这是该公司迄今为止速度最快、价格最实惠的小型模型。基准测试结果显示,其性能较前代实现大幅跃升,同时 Anthropic 还下调了 Sonnet 5.5 的价格。
据 Anthropic 介绍,Haiku 5.5 专为摘要、数据库查询、分类和实时客户支持等高用量、成本敏感型任务而设计。平均而言,该模型的成本比 Haiku 4.5 低约 75%。对于提示词不超过 100,000 token 的请求——Anthropic 称这类请求约占此前所有 Haiku 请求的 90%——价格降幅最高可达 90%。超过 100,000 token 的提示词成本则是其五倍。
| 每 100 万 token 价格 | Haiku 5.5(提示词不超过 / 超过 100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 缓存读取 | $0.01 / $0.05 | $0.10 | $0.10 |
| 缓存写入 | $0.125 / $0.625 | $1.25 | $2.50 |
| 输入 token | $0.10 / $0.50 | $1.00 | $2.00 |
| 输出 token | $0.50 / $2.50 | $5.00 | $10.00 |
Anthropic 指出,Haiku 5.5 使用了更新的分词器,每个任务消耗的 token 略多于前代。类似的情况也曾出现在 Opus 4.x 模型上,仅分词器变更就使 token 用量增加了约 30%。实际节省的成本可能低于按 token 单价所显示的水平。
基准测试显示较 Haiku 4.5 大幅跃升
Haiku 5.5 在知识基准 GDPval-AA v2.1 上得分 1,620,是前代 735 分的两倍多。在 Humanity's Last Exam 上,无工具得分 45.9%,有工具得分 57.4%,高于此前的 10.2% 和 18.7%。
提升最大的是计算机操作,即模型自行操作电脑。由于计算机操作会消耗大量 token,像 Haiku 5.5 这样便宜、快速的模型自然契合。其在 OSWorld-2.1 上得分 72.4%,高于此前的 15.7%。在智能体编程基准 Terminal-Bench 4.0 上,其得分达到 39.2%,而 Haiku 4.5 得分为零。
Anthropic 还列出了 OpenAI 的经济型模型 GPT-6 Luna 作为对比,Haiku 5.5 在所有测试类别中均领先。不过 Sonnet 5.5 的参考分数表明,Haiku 5.5 仍远远落后于 Anthropic 的更大模型。
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 | |
|---|---|---|---|---|
| 知识工作 / GDPval-AA v2.1 | 1,620 | 735 | 1,437 | 1,840 |
| 知识工作 / AA-Briefcase v1.1 | 1,578 | 614 | 1,336 | 1824 |
| 计算机操作 / OSWorld 2.1 | 72.4%(离线子集) | 15.7%(离线子集) | 48.9%(离线子集) | 83.9%(离线子集) |
| 多学科推理 / Humanity's Last Exam | 45.9%(无工具) | 10.2%(无工具) | — | 56.9%(无工具) |
| 57.4%(有工具) | 18.7%(有工具) | — | 64.5%(有工具) | |
| 智能体编程 / Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| 智能体编程 / FrontierCode 1.1(Main) | 46.4% | — | 42.4% | 52.1%(Xhigh) |
| 视觉推理 / Chartography | 46.4%(无工具) | 6.4%(无工具) | 29.1%(无工具) | 61.6%(无工具) |
首个 Haiku 模型让用户以成本换性能
Haiku 5.5 是首个具备可调推理等级的 Haiku 级模型,让用户可以在成本与质量之间取得平衡。Anthropic 表示,该模型最适合压缩、摘要或子智能体工作等范围明确的任务。对于复杂的智能体编程,Sonnet 5.5 和 Opus 5.5 仍是更好的选择。
网络安全防护比前代更严格,但允许的防御性任务范围比 Sonnet 5.5 更广,部分原因是该模型整体能力较弱。渗透测试仍被禁止。有更广泛需求的组织可以申请Anthropic 面向生命科学和网络安全的验证计划。
Haiku 5.5 现已在所有平台上线,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。
Sonnet 5.5 也更便宜了,Anthropic 还发放 API 额度
伴随 Haiku 的发布,Anthropic 正将 Sonnet 5.5 的缓存读取成本削减 50%,从每百万 tokens 0.20 美元降至 0.10 美元。该公司表示,这应能让大多数 agentic 任务的成本降低约 20%。此举几乎可以肯定是对 OpenAI 新的 GPT-6.1 系列 的回应,表明 AI 价格战正打得比以往任何时候都更激烈。
Anthropic 还在推出每月 API 额度。Max-5x 订阅者可获得 100 美元,Max-20x 订阅者可获得 200 美元,Team 订阅者每月最多可获得 500 美元。用户可以用这些额度通过 API 试验各种工具、应用和 agent。
该公司还在更新其 Python 和 TypeScript SDK,新增对 computer use 和 browser use 的 beta 支持。
没有炒作的人工智能新闻——由人工精选
订阅 THE DECODER,享受无广告阅读、每周 AI 新闻简报、我们每年六次的独家“AI Radar”前沿报告、完整档案访问权限,以及我们的评论区访问权限。
来源:The Decoder:AI News · the-decoder.com