Claude Code Fable 5推理强度被悄悄降低?官方回应仅为配置测试不影响实际性能

Claude Code Fable 5推理强度被悄悄降低?官方回应仅为配置测试不影响实际性能

💡 原文中文,约1200字,阅读约需3分钟。
📝

内容提要

开发者发现Claude Code中Fable 5模型在高努力设置下仍报告低推理分数,疑似降智。Claude Code团队成员回应称这是测试API配置,数值映射无实际意义,不影响实际性能,用户选择何种努力程度模型即按此推理。

🔎

延伸解读

数值映射的困惑

开发者发现高努力设置下模型自报低分,引发降智猜测。官方解释称这是测试API配置,数值映射并非0-100,且无独立意义。用户不必过度解读模型自报的分数,因为该数值可能只是测试中的临时映射,不代表实际推理强度。

简单问题与努力程度无关

官方强调,模型对简单问题仍会快速浅层思考,这与用户设置的努力程度无关。即使在高努力模式下,面对简单问题,模型也会选择简单推理,这是正常行为,并非降智。用户应区分模型对问题复杂度的自适应与整体推理能力的变化。

测试对性能的影响

Claude Code团队表示正在分析测试配置,确保不影响实际性能。用户选择何种努力程度,模型即按此推理。虽然测试可能引起数值显示异常,但官方承诺实际性能不受影响。建议用户关注实际输出质量,而非依赖自报分数。

Q&A

Claude Code中Fable 5模型被指推理强度降低是怎么回事?

有开发者发现,在Claude Code中使用Fable 5模型并设置高努力程度时,模型自身报告的努力程度分数仅为10分(满分100分),对应低努力程度,因此怀疑模型被降智。

Claude Code团队对Fable 5推理强度降低的回应是什么?

Claude Code团队成员@Thariq回应称,这是测试API服务配置,努力程度的数值映射并非0~100,这些数值本身没有独立意义,用户选择什么努力程度,模型就会以相同的努力程度推理,测试不会影响实际性能。

开发者如何发现Fable 5可能被降智?

开发者通过询问模型当前的努力程度来发现,即使设置了高努力程度,模型仍报告努力程度为10分(低),设置xHigh时报告40分(中等),与预期不符。

Claude Code中努力程度的数值映射是否固定为0到100?

不是。Claude Code团队成员表示,目前努力程度的数值映射并非0~100,这些数值本身没有独立意义,只是测试配置的一部分。

为什么模型对简单问题也会报告低努力程度?

因为模型对于简单问题会以简单方式进行思考,这与用户设置的努力程度无关,是模型根据问题复杂度自动调整的。

社区对Fable 5推理强度降低的猜测是什么?

社区猜测这可能是A社(Anthropic)在服务端执行的更改,压缩努力级别的数字映射,或者正在进行A/B对照测试。

🏷️

标签

➡️

继续阅读