同样选“high”,Claude Code却像少想了一会儿。对开发者来说,这种变化尤其难判断:是代码太难,还是云端悄悄换了配置?据 Claude Code Daily Briefing 报道,2.1.236及之后版本的部分 Fable 5 会话被纳入服务端实验,界面显示的 effort 档位可能对应更小的实际推理尺度;旧版本和 Opus 5不受影响,也并非所有用户都会遇到。
Effort即“推理强度”,控制模型回答或行动前投入多少思考。Anthropic文档称,调低它通常能减少Token用量、延迟和成本,但会牺牲一定能力。由于配置来自服务端,Anthropic无需更新客户端,就能把部分用户放入不同配置组做A/B测试。
争议不只在于模型是否变弱,更在于用户看到的档位是否仍代表相同体验。Anthropic此前确认调整过Claude Code的默认推理强度,并称内部测试中medium在多数任务上仅略降能力、却显著降低延迟。不过,本次公开材料没有披露实验比例、持续时间和效果数据,目前仍不足以判断影响范围。