根据新智元2026年8月25日报道,开发者发现Claude Code在服务端将“high”推理档位映射为数值“10”并纳入A/B实验,Anthropic工程师承认正在测试但声称不影响性能;同时公开承认Opus 5模型“表现很不稳定”。事件再次引发对大模型版本更新不透明、跑分与用户体感脱钩的讨论。
开发者argofowl发现Claude Code“变笨”,排查了t3 code、自己的代码甚至Mac故障,最终在API请求日志中看到推理档位数字为「10」,而他在后台选择的是最高档“high”。 社区反馈显示,从Claude Code 2.1.237开始,“high”被读取为10 out of 100,而10过去对应“low”档;Anthropic将Cla…