内容提要
A社发布Claude Fable/Mythos 5.1模型,支持1M上下文窗口和128K输出,能力显著提升,尤其在科学和编程领域。API价格不变,但缓存读取价格暴降75%。Mythos 5.1放宽安全限制,仅限认证机构使用。
延伸解读
缓存降价的实际影响
缓存读取价格从1美元降至0.25美元,降幅达75%,这对频繁使用长上下文和重复提示词的开发者影响显著。在大量使用缓存的情况下,API调用成本将大幅降低,尤其适合需要处理长文档或进行多轮对话的应用场景。不过,普通输入和输出价格未变,因此对于不依赖缓存的短任务,成本节省有限。
安全限制的差异化策略
Fable 5.1和Mythos 5.1基于相同基础模型,但安全限制不同。Mythos 5.1放宽了网络安全和生命科学领域的限制,仅面向认证机构,这反映了AI安全与科研需求之间的平衡。普通用户和开发者只能使用Fable 5.1,而高风险领域的研究机构则可通过审核获得更强的模型能力,但需承担相应的责任。
性能提升的评测解读
在Terminal-Bench-Science 0.1评测中,Fable 5.1得分52.6%,是Fable 5(24.7%)的两倍多,也高于Opus 5(29)。在Terminal-Bench 4.0中,Mythos 5.1达到60.9%,高于Fable 5.1的55.8%。这些数据表明,解除安全限制后,模型在科学任务上的表现有进一步提升,但实际应用效果还需结合具体场景验证。
Q&A
Claude Fable 5.1和Mythos 5.1的主要区别是什么?
两者基于相同的基础模型,主要区别在于安全限制:Fable 5.1面向普通用户和开发者,而Mythos 5.1减少了网络安全和生命科学领域的限制,仅面向经过审核的专业机构提供。
Claude Fable 5.1在哪些能力上有所提升?
Fable 5.1重点提升了长时程智能体任务、编程开发、知识工作和科学研究领域的能力,在Terminal-Bench-Science 0.1评测中得分52.6%,明显高于Fable 5的24.7%和Opus 5的29。
Claude Fable 5.1和Mythos 5.1的上下文窗口和输出长度是多少?
两者均支持1M上下文窗口和最高128K输出,支持文字和图片输出,并始终开启Adaptive Thinking,可调整推理强度,默认使用高努力推理。
Claude Mythos 5.1在科学研究方面有哪些具体表现?
Mythos 5.1设计的蛋白质结合物在12个目标中的有效命中率接近50%,针对部分目标结合亲和力达到现有竞赛最佳方案的10倍;还为七个开源蛋白质和基因组模型编写GPU内核,最高将推理速度提升2.5倍,使部分全基因组分析的估算GPU成本降低30%~60%。
Claude Fable 5.1的API价格和缓存价格有何变化?
API调用价格与Fable 5系列持平,普通输入10美元/MTok,输出50美元/MTok,但缓存读取价格降至0.25美元/MTok,暴降75%,因此大量使用缓存时成本会显著减少。
A社对使用Claude Fable 5.1有什么建议?
A社称Fable 5.1仍属于价格较高的模型,建议普通工作优先使用Opus 5,只有复杂推理和长时程智能体任务再切换为Fable 5.1这类能力更强的前沿模型。