内容提要
Anthropic发布Fable 5.1和Mythos 5.1模型,性能提升且缓存读取价格降低75%。Fable 5.1在科学基准测试中大幅进步,安全防护干预减少,并推出零数据保留的Enterprise Frontier Safeguards,同时加强防蒸馏措施,检测API开放给欧盟合规机构。
延伸解读
缓存降价的实际影响
缓存读取价格从每百万token 1美元降至0.25美元,降幅达75%。对于高频调用相同上下文的场景,如长对话或代码库分析,成本将显著降低。但输入输出token价格未变,因此整体费用节省取决于缓存命中率。开发者需评估自身使用模式,以确定实际收益。
安全干预减少的权衡
Fable 5.1的网络安全防护干预减少60%,生物安全防护干预减少85%,且现在允许识别代码漏洞。但渗透测试、漏洞利用生成和二进制扫描仍被禁止,并会重定向至Opus模型。这表明Anthropic在放宽对良性请求的限制,同时保留对高风险活动的管控,用户需注意合规边界。
零数据保留的替代方案
针对企业客户的数据保留顾虑,Anthropic推出Enterprise Frontier Safeguards(EFS),将数据存储在客户自己的云存储中,使用客户加密密钥,并运行自动化检测,无人工审查。EFS将分阶段推出,覆盖Claude Code、Claude Enterprise等平台,且不额外收费。在此之前,符合条件的客户可使用零数据保留选项。
防蒸馏措施对开发者的影响
为应对模型蒸馏,Anthropic禁止新账户在多轮对话中手动编辑Claude的先前上下文,同时保留思考记录。这会影响依赖对话历史压缩或重写的代理工具,但现有账户在未来的模型版本中也将受限。开发者需调整工作流,避免依赖此类编辑功能。
Q&A
Anthropic新发布的Fable 5.1模型在价格和性能上有哪些改进?
Fable 5.1的缓存读取价格降低了75%,从每百万token 1美元降至0.25美元,而输入/输出价格保持不变(每百万token 10美元/50美元)。性能上,Fable 5.1在大多数基准测试中优于Fable 5,尤其在科学研究的Terminal-Bench-Science 0.1上得分从24.7%提升至52.6%。
Fable 5.1在安全防护方面有哪些调整?
Anthropic使安全防护更精准,减少对良性内容的误判。网络安全的干预次数比Fable 5减少了约60%,生物安全防护对良性请求的干预减少了85%。同时,模型现在可以识别代码中的漏洞,但渗透测试、漏洞利用生成和二进制扫描仍被禁止。
什么是Enterprise Frontier Safeguards (EFS)?它如何工作?
EFS是Anthropic推出的新系统,旨在为零数据保留(ZDR)客户提供隐私保护,同时保留监控滥用的能力。它通过将数据存储在客户完全控制的云基础设施(如Amazon S3、Azure Blob Storage或Google Cloud Storage)中,使用客户的加密密钥加密,然后运行Anthropic的自动化检测,无需人工审查,并将警报路由给客户。EFS将于今年秋季开始分阶段推出,期间符合条件的客户可使用Fable 5.1且零数据保留。
Anthropic如何防止模型被蒸馏?
Anthropic加强了防蒸馏机制,包括API变更:新账户不能再手动编辑多轮对话中的先前上下文,同时保留Claude先前思考的转录。这关闭了一种常见的、公开记录的蒸馏技术。该限制将扩展到未来模型版本的现有账户。
Fable 5.1的检测API是做什么的?谁可以使用?
检测API用于验证文本是否由Claude生成,基于Anthropic的水印技术。该API以私有预览形式向符合欧盟法律要求的组织开放,如监管机构、执法部门、媒体、事实核查人员、独立研究人员、教育组织和欧盟民间社会团体。此外,有义务验证水印以符合欧盟AI法案的企业也可访问,未来将更广泛推出。
Fable 5.1与Fable 5相比,在科学基准测试中的表现如何?
在Terminal-Bench-Science 0.1基准测试中,Fable 5.1得分52.6%,而Fable 5仅为24.7%,提升显著。在其他大多数领域,改进幅度在2-4%之间。