Anthropic发布Claude Sonnet 5.5:性能接近Opus,价格仅一半

Anthropic发布Claude Sonnet 5.5:性能接近Opus,价格仅一半

💡 原文英文,约800词,阅读约需3分钟。
📝

内容提要

Anthropic发布Claude Sonnet 5.5,速度较上代提升逾30%,单任务成本最多降低30%,擅长编程、文档与幻灯片制作。Terminal-Bench 4.0得分70.6%,远超Sonnet 5的10.3%。定价不变,每百万输入2美元、输出10美元。已在Claude平台及AWS、谷歌云、微软Azure上线,并首次为Sonnet配备网络安全防护与推理防提取分类器。

🔎

延伸解读

性能跃升与成本优势

Sonnet 5.5在Terminal-Bench 4.0上得分70.6%,远超Sonnet 5的10.3%,甚至略高于Opus 5.5的66.4%。同时,其输出速度提升超30%,单任务成本最多降低30%,且定价保持不变。这意味着在编程等任务上,用户能以更低成本获得接近Opus的性能,但需注意Opus在复杂开放式任务上仍明显更强。

定价策略与竞争对比

尽管Anthropic下调了Opus 5.5的价格,OpenAI也半价调整了GPT-6 Sol和Luna,但Sonnet 5.5的定价仍为每百万输入2美元、输出10美元,与GPT-6 Sol相同。不过,由于新模型使用的token更少,实际运行成本可能低于Sonnet 5。读者需关注实际使用中的token消耗,以评估真实成本。

安全防护与迁移注意

Sonnet 5.5是首个配备网络安全防护和推理防提取分类器的Sonnet模型。常规bug修复不受影响,但高风险网络安全请求会回退到Sonnet 5。此外,开发者若之前关闭了思考功能,迁移到Sonnet 5.5前需改用新的between_tools设置,否则可能遇到兼容性问题。

❓

Q&A

Claude Sonnet 5.5 相比上一代 Sonnet 5 有哪些主要提升?

Claude Sonnet 5.5 生成输出速度比 Sonnet 5 快超过30%,单任务成本最多降低30%,在编程、文档和幻灯片制作等任务上表现更强。在 Terminal-Bench 4.0 上得分70.6%,远高于 Sonnet 5 的10.3%。

Claude Sonnet 5.5 的定价是多少?

定价保持不变,每百万输入 token 2美元,每百万输出 token 10美元,缓存读取每百万 token 0.20美元。

Claude Sonnet 5.5 在哪些平台上可以使用?

已在 Claude 平台、Amazon Web Services、Google Cloud 和 Microsoft Azure 上线。

Claude Sonnet 5.5 在编程任务上的表现如何?

在 Terminal-Bench 4.0 上得分70.6%,超过 Opus 5.5 的66.4%;在 CursorBench 上接近 Opus 5.5 约2分;在 FrontierCode 上得分52.1%,略低于 Opus 5.5 的54.4%,但高于 GPT-6 Sol 的49.3%。

Claude Sonnet 5.5 与 Opus 5.5 相比有哪些差距?

Sonnet 5.5 在多个基准测试中接近 Opus 5.5,例如 GDPval-AA 仅差2分,但在复杂、开放式且需要持续判断的工作上,Opus 5.5 仍然明显更强。

Claude Sonnet 5.5 在安全方面有哪些新特性?

这是首个配备与 Opus 5.5 相同网络安全防护的 Sonnet 模型,高风险网络安全请求会回退到 Sonnet 5;也是首个带有分类器以防止攻击者提取其推理过程来训练自己模型的 Sonnet 模型。

🏷️

标签

➡️

继续阅读