AI Pulse

你选“高努力”,算力可能只剩一周前的四分之一

Claude Code 是 Anthropic 的编程助手,里面有个 effort 参数。你选“high”,模型就会花更多算力思考,状态栏也会亮出“high”字样。

有人对比了新旧版本,发现 effort 参数在不同版本里对应的数值不一样。他让模型自己输出当前的 reasoning_effort 数值——8月18日的 2.1.235 版里,“high”对应 40;最新 2.1.240 版里,“high”只对应 10,“xhigh”从 120 降到了 40。测试条件一模一样:同一台 Mac、同一个账号、同一条命令,唯一换掉的是 Claude Code 的二进制版本。按这份数据,最新版里选“高努力”,模型分到的算力预算只有上周的四分之一。

Anthropic 员工 Thariq 在 Twitter 上回应了这事。他说他们有时会在 Claude Code 里先测试 API 服务配置,当前运行的配置确实改了数值映射。但他强调,努力值不是 0 到 100 的尺度,数字本身没有意义,“你选择的努力级别就是你实际获得的努力级别”。团队还做了深入评估,确认这不影响性能。

这个改动在官方更新日志里没有任何痕迹。从 2.1.236 到 2.1.240,日志三次提到 effort,但全是外观改动:状态徽章的颜色、缓存未命中的警告。没有一处提及数值尺度的调整。你选了 high,状态栏显示 high,模型实际拿到的预算已经缩水了。

复测的结果并不一致。有人在 2.1.240 上跑同样的命令,得到的 reasoning_effort 是 40 而不是 10,说明服务器端的配置可能因人而异。还有人提出了另一层怀疑:如果所有思考级别的算力都被压缩,模型消耗的思考令牌应该变少,每周限额和五小时限额的用量也该下降。但实际没有——这可能意味着每个思考令牌的成本被同时提高了。还有人说,自己用得多了,令牌消耗量却在下降。而 Anthropic 此前刚宣布过“50% 临时提升”,两件事对不上。

讨论里也有相反的看法。有人认为,配置既然发生在服务器端,本地用哪个版本根本无关紧要。也有人说外部探测没有意义,数字只是被编程为某种含义。还有人觉得,大多数说模型被削弱的人只是疲劳或提示不当,受了社交媒体讨论的影响。

Thariq 的回应确认了映射变了,也坚持“你选择的努力级别就是你实际获得的级别”。但他没有解释,为什么同一个“high”在两个版本里对应 40 和 10 两个数字。他也没有说明这个配置会不会扩散到 API 正式版或网页端。Opus 4.8 是否经历了同样的调整,目前只有零散猜测。

阅读原文
📚 相关主题 大模型

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新