Anthropic以大幅降低的价格发布Haiku 5.5

Anthropic以大幅降低的价格发布Haiku 5.5

💡 原文英文,约900词,阅读约需4分钟。
📝

内容提要

Anthropic发布Claude Haiku 5.5,速度更快、价格更低,每百万token输入/输出仅0.10/0.50美元,平均节省约75%。新增effort控制,适用于摘要、分类、客服等任务。基准测试大幅超越Haiku 4.5,部分领先GPT-6 Luna。同时Sonnet 5.5缓存读取价减半,Max和Team订阅新增API额度。

🔎

延伸解读

价格策略与成本影响

Haiku 5.5的定价大幅下调,对于请求量低于10万token的任务,输入/输出价格仅为每百万token 0.10/0.50美元,相比Haiku 4.5的1/5美元,降幅达90%和90%。对于更大请求,价格为0.50/2.50美元,降幅50%。Anthropic指出约90%的Haiku 4.5请求属于低价类别,因此多数开发者将享受显著成本节约。平均节省约75%,这得益于混合请求和更新后的分词器。

性能提升与基准表现

Haiku 5.5在多项基准测试中大幅超越前代。在OSWorld 2.1计算机使用测试中得分72.4%,远高于Haiku 4.5的15.7%和GPT-6 Luna的48.9%。在GDPval-AA v2.1知识工作基准上得分1,620,对比Haiku 4.5的735和GPT-6 Luna的1,437。在Terminal-Bench 4.0复杂命令行任务中得分39.2%,而Haiku 4.5为0%,GPT-6 Luna为16.4%。不过Sonnet 5.5仍保持领先。

竞争格局与替代选择

尽管Haiku 5.5性能提升,但小型模型市场竞争激烈。Z.ai的GLM-5.3-Flash在GDPval-AA v2.1上得分1,647,略高于Haiku 5.5的1,620。阿里国际服务的Qwen3.7 Flash价格更低,输入每百万token仅0.03美元(32k token以内),输出0.13美元。开发者需权衡性能与成本,Haiku 5.5在计算机使用等任务上优势明显,但其他模型可能在某些场景更具性价比。

配套更新与使用注意

Anthropic同时将Sonnet 5.5的缓存读取价格减半至每百万token 0.10美元,预计使多数代理任务成本降低约20%。Max和Team订阅新增月度API额度:Max 5x获100美元,Max 20x获200美元,Team最多500美元共享。Haiku 5.5还加强了网络安全防护,但禁止渗透测试,需要更广访问的组织可申请验证计划。

❓

Q&A

Claude Haiku 5.5 的定价是多少?

对于少于 100,000 token 的请求,输入价格为每百万 token 0.10 美元,输出价格为每百万 token 0.50 美元。对于更大的请求,输入价格为每百万 token 0.50 美元,输出价格为每百万 token 2.50 美元。

Haiku 5.5 相比 Haiku 4.5 在价格上能节省多少?

Anthropic 估计平均节省约 75%。对于大多数请求(低于 100,000 token),输入和输出价格分别降低了 90% 和 50%。

Haiku 5.5 新增的 effort 控制是什么?

effort 控制允许开发者控制模型在给定任务上使用的 token 数量,默认设置为中等。这是 Haiku 模型首次引入该功能。

Haiku 5.5 在基准测试中的表现如何?

在 OSWorld 2.1 上得分 72.4%(Haiku 4.5 为 15.7%,GPT-6 Luna 为 48.9%);在 GDPval-AA v2.1 上得分 1,620(Haiku 4.5 为 735,GPT-6 Luna 为 1,437);在 Terminal-Bench 4.0 上得分 39.2%(Haiku 4.5 为 0%,GPT-6 Luna 为 16.4%)。

Haiku 5.5 适用于哪些任务?

适用于高容量任务如摘要、分类、路由,以及压缩、数据库查询、代理工作负载(如实时客户支持和浏览器使用)等速度重要的场景。

Anthropic 还宣布了哪些其他更新?

Sonnet 5.5 的缓存读取价格减半,从每百万 token 0.20 美元降至 0.10 美元,使大多数代理任务成本降低约 20%。此外,Max 和 Team 订阅新增每月 API 额度:Max 5x 获得 100 美元,Max 20x 获得 200 美元,Team 订阅者共享最多 500 美元。

🏷️

标签

➡️

继续阅读