Anthropic Engineering
Anthropic 复盘:一个月的 Claude Code 抱怨,源头是三个各自独立的改动
三个毫不相干的改动叠在一起,看上去就像 Claude Code、Agent SDK 和 Cowork 集体出现大面积、时好时坏的降智,而 API 自始至终没受影响。3 月 4 日默认 reasoning effort 从 high 降到了 medium;3 月 26 日的一次缓存优化带了个 bug,会话一旦过期,每一轮都会丢掉 Claude 之前的推理过程;4 月 16 日 system prompt 里加的一句「回答控制在 100 词以内」,让 Opus 4.6 和 4.7 的评测分数都掉了约 3%。三个问题在 4 月 20 日全部修复,默认值现在是 Opus 4.7 用 xhigh、其余一律 high,所有订阅用户的用量额度也在重置。这次调查里有个细节值得记一笔:拿出问题的那几个 PR 回测,Opus 4.7 揪出了缓存那个 bug,Opus 4.6 没有。
- #products
- #evals
