Anthropic Engineering
Anthropic 覆盤:一個月的 Claude Code 抱怨,源頭是三個各自獨立的改動
三個毫不相干的改動疊在一起,看上去就像 Claude Code、Agent SDK 和 Cowork 集體出現大面積、時好時壞的降智,而 API 自始至終沒受影響。3 月 4 日預設 reasoning effort 從 high 降到了 medium;3 月 26 日的一次快取最佳化帶了個 bug,會話一旦過期,每一輪都會丟掉 Claude 之前的推理過程;4 月 16 日 system prompt 里加的一句「回答控制在 100 詞以內」,讓 Opus 4.6 和 4.7 的評測分數都掉了約 3%。三個問題在 4 月 20 日全部修復,預設值現在是 Opus 4.7 用 xhigh、其餘一律 high,所有訂閱使用者的用量額度也在重置。這次調查裡有個細節值得記一筆:拿出問題的那幾個 PR 回測,Opus 4.7 揪出了快取那個 bug,Opus 4.6 沒有。
- #products
- #evals
