内容提要
Claude Opus 5回答过长,因模型变聪明而话多。effort参数控制思考深度而非输出长度,正确做法是用提示词明确要求简洁,如“Keep responses focused, brief, and concise.”。同时应删除冗余指令,信任模型能力,用effort控成本,提示词控长度,并注意max_tokens需给思考留空间。
延伸解读
effort与提示词的分工
effort参数控制的是模型的思考深度,而非输出长度。降低effort不会可靠地缩短回答,反而可能降低质量。正确做法是用提示词明确要求简洁,如“Keep responses focused, brief, and concise.”。effort用于控制成本和速度,提示词用于控制表达长度和风格,两者各司其职。
提示词策略的转变
新模型如Opus 5能力更强,许多旧提示词指令变得冗余甚至有害。Anthropic删除了Claude Code超过80%的系统提示词,性能未降。应删除验证指令、限制任务范围,用少量高质量约束引导模型,而非事无巨细地交代。
max_tokens的陷阱
启用思考功能时,max_tokens限制的是思考Token与回答Token的总和。设置过低会截断思考过程,导致回答质量下降。官方建议从64K令牌开始,并根据effort级别调整。成本控制应结合effort和提示词,而非单纯依赖max_tokens。
Q&A
Claude Opus 5回答太长怎么办?
在提示词中明确要求简洁,例如添加“Keep responses focused, brief, and concise.”,并可以加上篇幅分配原则,如“Keep disclaimers and caveats short, and spend most of the response on the main answer.”。不要依赖降低effort参数来控制长度。
effort参数能控制Claude Opus 5的回答长度吗?
不能。effort参数控制的是模型思考的深度和推理链的长度,而不是可见响应的长度。降低effort可以减少思考量,但不能可靠地缩短回答。官方文档明确指出,降低effort不会可靠地缩短可见响应。
Claude Opus 5为什么回答变长了?
因为模型变聪明了,它倾向于把问题解释得更全面、更细致,导致回答变长。这不是Bug,而是模型能力提升后的副作用。
如何正确使用effort参数和提示词来控制Claude Opus 5?
用effort控制成本和速度,用提示词控制回答长度。effort管“想多久”,提示词管“说多少”。例如,保持effort在high,在提示词中加入简洁要求,即可在保持思考深度的同时缩短回答。
Claude Opus 5的提示词策略有什么新变化?
新范式是“减法”而非“加法”:删除冗余指令,信任模型能力。例如,Anthropic删除了Claude Code超过80%的系统提示词,性能没有下降。应删除验证指令、限制任务范围,并重新评估effort设置。
Claude Opus 5的max_tokens设置有什么需要注意的?
如果启用了思考功能(默认开启),max_tokens限制的是思考Token和回答Token的总和。如果设置过低,思考过程可能被截断,导致回答质量下降。官方建议从64K令牌开始,并根据effort级别调整。
Claude Opus 5的effort级别有哪些?分别适用于什么场景?
effort有五个级别:low、medium、high、xhigh、max。默认是high。low适用于简单任务和子智能体;medium适用于需要平衡速度、成本和性能的代理任务;high适用于复杂推理和困难编码;xhigh和max用于长时间运行的智能体和能力要求极高的工作。