Fable 5高effort实际只跑10分:CC偷换推理刻度 静默降级

Fable 5高effort实际只跑10分:CC偷换推理刻度 静默降级

💡 原文中文,约3300字,阅读约需8分钟。
📝

内容提要

开发者发现Claude Code将“high”推理档静默映射为低档数值,质疑付费高档却获低质服务。Anthropic回应称数字无意义、性能不变,但用户反馈模型变笨、响应变快,且抓包显示high与low的推理量相同。此事引发信任危机,因Anthropic此前已有类似静默降级前科,开发者担忧参数变更影响工作流且无日志可查。

🔎

延伸解读

effort参数传递机制:系统提示词而非请求参数

开发者质疑请求中未包含数字,但多位开发者指出,effort是通过系统提示词传递的,而非请求参数。切换effort档位会导致缓存失效,这印证了提示词变化影响缓存key。因此,模型回答中的数字可能只是复述系统提示,而非服务器端注入。用户需理解这一机制,避免误判。

信任危机:静默变更的代价

Anthropic在两个月内两次被曝静默调整模型行为,先是对敏感领域降级,后是调整effort刻度。尽管官方声称不影响性能,但用户反馈模型变笨、响应变快,且无更新日志可查。这种缺乏透明度的做法破坏了开发者对平台的信任,尤其对依赖模型输出构建工作流的用户影响深远。

用户如何自查与应对

面对可能的静默变更,开发者可主动询问模型当前effort数值,或抓包检查系统提示词。但更根本的是,关注官方更新日志和社区反馈。若怀疑降级,可对比不同档位的thinking token数量或响应速度。对于关键任务,考虑本地开源模型或保留旧版本,以减少对服务端配置的依赖。

Q&A

Claude Code 的 Fable 5 高推理档位被指静默降级是怎么回事?

开发者抓包发现,Claude Code 将“high”推理档位映射为数值10,而10原本对应“low”档位,且更新日志未提及此变更。用户质疑付费高档却获得低档服务,但Anthropic回应称数字无意义,性能不变。

Anthropic 对 Fable 5 推理档位映射问题的官方回应是什么?

Anthropic员工Thariq回应称,他们正在测试不同的API服务配置,数值映射方式不同,但强调scale不是0到100,数字本身没有意义,用户选择的effort就是得到的effort,且经过内部评估确认不影响模型性能。

用户如何发现 Fable 5 的 high 档位被静默降级?

开发者通过抓包检查请求数据,发现请求中只包含“high”标签,但模型返回的数值是10,而10原本对应low档。此外,用户观察到模型响应变快、分析变浅,且抓包显示high档的thinking token数量与low档相同。

Fable 5 的 effort 参数是什么?它如何影响模型行为?

effort参数控制模型在回答前投入的思考量,有low、medium、high、xhigh、max五个档位。高effort意味着更多工具调用、更完整规划、更长输出,但消耗更多token;低effort则响应更快、步骤更少。

为什么说 effort 是通过系统提示词传递给模型的?

开发者指出,reasoning effort是通过系统提示词传递的,而非请求参数。用户在界面选择档位后,客户端会在系统提示中写入相应文字,模型读取提示后执行。切换effort会导致缓存失效,也印证了这一点,因为提示词变化导致缓存key变化。

Anthropic 之前是否有过类似静默降级的行为?

是的,2026年6月,Fable 5发布后不久,Anthropic被曝在系统卡中隐藏静默降级机制,当用户请求涉及敏感领域时,模型会悄悄将请求转给更弱的Opus 4.8,不通知用户。社区抗议后,Anthropic在24小时内道歉并撤回该机制。

这次静默降级事件对开发者信任造成了什么影响?

开发者认为静默参数变更没有更新日志,破坏了可复现性和信任,导致调试成本增加,因为开发者会先怀疑自己的代码。有开发者表示因此转向本地开源权重模型,以避免被悄悄降级。

🏷️

标签

➡️

继续阅读