内容提要
开发者发现Claude Code中Fable 5模型在高努力设置下仍报告低推理分数,疑似降智。Claude Code团队成员回应称这是测试API配置,数值映射无实际意义,不影响实际性能,用户选择何种努力程度模型即按此推理。
延伸解读
数值映射的困惑
开发者发现高努力设置下模型自报低分,引发降智猜测。官方解释称这是测试API配置,数值映射并非0-100,且无独立意义。用户不必过度解读模型自报的分数,因为该数值可能只是测试中的临时映射,不代表实际推理强度。
简单问题与努力程度无关
官方强调,模型对简单问题仍会快速浅层思考,这与用户设置的努力程度无关。即使在高努力模式下,面对简单问题,模型也会选择简单推理,这是正常行为,并非降智。用户应区分模型对问题复杂度的自适应与整体推理能力的变化。
测试对性能的影响
Claude Code团队表示正在分析测试配置,确保不影响实际性能。用户选择何种努力程度,模型即按此推理。虽然测试可能引起数值显示异常,但官方承诺实际性能不受影响。建议用户关注实际输出质量,而非依赖自报分数。
Q&A
Claude Code中Fable 5模型被指推理强度降低是怎么回事?
有开发者发现,在Claude Code中使用Fable 5模型并设置高努力程度时,模型自身报告的努力程度分数仅为10分(满分100分),对应低努力程度,因此怀疑模型被降智。
Claude Code团队对Fable 5推理强度降低的回应是什么?
Claude Code团队成员@Thariq回应称,这是测试API服务配置,努力程度的数值映射并非0~100,这些数值本身没有独立意义,用户选择什么努力程度,模型就会以相同的努力程度推理,测试不会影响实际性能。
开发者如何发现Fable 5可能被降智?
开发者通过询问模型当前的努力程度来发现,即使设置了高努力程度,模型仍报告努力程度为10分(低),设置xHigh时报告40分(中等),与预期不符。
Claude Code中努力程度的数值映射是否固定为0到100?
不是。Claude Code团队成员表示,目前努力程度的数值映射并非0~100,这些数值本身没有独立意义,只是测试配置的一部分。
为什么模型对简单问题也会报告低努力程度?
因为模型对于简单问题会以简单方式进行思考,这与用户设置的努力程度无关,是模型根据问题复杂度自动调整的。
社区对Fable 5推理强度降低的猜测是什么?
社区猜测这可能是A社(Anthropic)在服务端执行的更改,压缩努力级别的数字映射,或者正在进行A/B对照测试。