Claude Fable/Mythos 5.1发布 能力显著提升 缓存价格暴降75%

Claude Fable/Mythos 5.1发布 能力显著提升 缓存价格暴降75%

💡 原文中文,约1400字,阅读约需4分钟。
📝

内容提要

A社发布Claude Fable/Mythos 5.1模型,支持1M上下文窗口和128K输出,能力显著提升,尤其在科学和编程领域。API价格不变,但缓存读取价格暴降75%。Mythos 5.1放宽安全限制,仅限认证机构使用。

🔎

延伸解读

缓存降价的实际影响

缓存读取价格从1美元降至0.25美元,降幅达75%,这对频繁使用长上下文和重复提示词的开发者影响显著。在大量使用缓存的情况下,API调用成本将大幅降低,尤其适合需要处理长文档或进行多轮对话的应用场景。不过,普通输入和输出价格未变,因此对于不依赖缓存的短任务,成本节省有限。

安全限制的差异化策略

Fable 5.1和Mythos 5.1基于相同基础模型,但安全限制不同。Mythos 5.1放宽了网络安全和生命科学领域的限制,仅面向认证机构,这反映了AI安全与科研需求之间的平衡。普通用户和开发者只能使用Fable 5.1,而高风险领域的研究机构则可通过审核获得更强的模型能力,但需承担相应的责任。

性能提升的评测解读

在Terminal-Bench-Science 0.1评测中,Fable 5.1得分52.6%,是Fable 5(24.7%)的两倍多,也高于Opus 5(29)。在Terminal-Bench 4.0中,Mythos 5.1达到60.9%,高于Fable 5.1的55.8%。这些数据表明,解除安全限制后,模型在科学任务上的表现有进一步提升,但实际应用效果还需结合具体场景验证。

Q&A

Claude Fable 5.1和Mythos 5.1的主要区别是什么?

两者基于相同的基础模型,主要区别在于安全限制:Fable 5.1面向普通用户和开发者,而Mythos 5.1减少了网络安全和生命科学领域的限制,仅面向经过审核的专业机构提供。

Claude Fable 5.1在哪些能力上有所提升?

Fable 5.1重点提升了长时程智能体任务、编程开发、知识工作和科学研究领域的能力,在Terminal-Bench-Science 0.1评测中得分52.6%,明显高于Fable 5的24.7%和Opus 5的29。

Claude Fable 5.1和Mythos 5.1的上下文窗口和输出长度是多少?

两者均支持1M上下文窗口和最高128K输出,支持文字和图片输出,并始终开启Adaptive Thinking,可调整推理强度,默认使用高努力推理。

Claude Mythos 5.1在科学研究方面有哪些具体表现?

Mythos 5.1设计的蛋白质结合物在12个目标中的有效命中率接近50%,针对部分目标结合亲和力达到现有竞赛最佳方案的10倍;还为七个开源蛋白质和基因组模型编写GPU内核,最高将推理速度提升2.5倍,使部分全基因组分析的估算GPU成本降低30%~60%。

Claude Fable 5.1的API价格和缓存价格有何变化?

API调用价格与Fable 5系列持平,普通输入10美元/MTok,输出50美元/MTok,但缓存读取价格降至0.25美元/MTok,暴降75%,因此大量使用缓存时成本会显著减少。

A社对使用Claude Fable 5.1有什么建议?

A社称Fable 5.1仍属于价格较高的模型,建议普通工作优先使用Opus 5,只有复杂推理和长时程智能体任务再切换为Fable 5.1这类能力更强的前沿模型。

🏷️

标签

➡️

继续阅读