昨天(4月23日),Anthropic 做了一件少見的事:公開承認了錯誤。
不是公關措辭含糊帶過,而是列出了三個具體的技術決定——哪天改的、改了什麼、為什麼改、造成了什麼後果、哪天修回來的。
從 3 月初到 4 月中,這三個改動疊加在一起,讓 Claude Code 在使用者眼裡越來越笨。很多人以為是模型退化,其實是三個可以定位到具體時間點的決定。
第一個錯:偷偷把 Claude 調成了省力模式
時間:3 月 4 日
Claude Code 的預設推理深度,從 high(高)改成了 medium(中)。理由是降低延遲,讓回應更快。
結果是用戶明顯感覺 Claude Code 變笨了。提問一樣,輸出品質下滑。
Anthropic 的結論:「這是錯誤的權衡。我們在 4 月 7 日回滾了這個改動,因為用戶告訴我們,他們更希望預設是高智慧,需要的時候才主動選低延遲。」
這件事三月中就有大量用戶在報告,當時 Anthropic 沒有公開說明原因。這次才正式承認:不是 Bug,是一個主動做的錯誤決定。
出問題到修好:超過一個月。
第二個錯:快取最佳化引入了健忘 Bug
時間:3 月 26 日
工程團隊在做快取最佳化時,引入了一個 Bug:
正常邏輯——思維會話快取在使用者一段時間不操作後才清除。Bug 出現後,變成了每次使用者發送訊息都清除一次。
結果是 Claude 在對話裡變得健忘且重複。剛說過的事,下一條訊息就忘了。用戶以為是智慧退化,實際上是記憶體在漏。
Anthropic 的話:「這不是使用者在使用 Claude Code 時應該經歷的體驗。」
修復時間:4 月 10 日。
出問題到修好:15 天。
第三個錯:加了字數限制,效能掉了 3%
時間:4 月 16 日
Anthropic 修改系統提示詞,加入了兩個上限:
- 工具呼叫之間:最多25 個詞
- 最終回答:最多100 個詞
目的是讓 Claude 更簡潔。結果內部測試發現效能下降了3%。
4 月 20 日,這個改動被回滾了。
出問題到修好:4 天——比第二個 Bug 快很多,原因是這次至少有內部測試數據撐著。
三個錯誤疊在一起
時間線拉出來看:
| 改動時間 | 具體內容 | 修復時間 |
|---|---|---|
| 3 月 4 日 | 推理深度 high → medium | 4 月 7 日(>1 個月) |
| 3 月 26 日 | 快取 Bug,每次清空 | 4 月 10 日(15 天) |
| 4 月 16 日 | 系統提示詞字數限制 | 4 月 20 日(4 天) |
用戶的感受是:Claude 一直在變差,但說不清楚是哪裡不對。
因為這三個問題同時在起作用。用戶報告的症狀混雜在一起,Anthropic 自己定位也需要時間。
公開復盤之後
Anthropic 的承諾是三件事:改進測試流程、有變化提前告知用戶、重置受影響帳號的使用額度。
承認錯誤這件事本身,在 AI 行業裡算少見。願意拿著具體時間節點和數字出來講,不繞彎子,比大多數公司做得好。
但有一個細節值得注意:第三個 Bug,是 Anthropic 做了內部測試之後才發布的——然後還是發現 3% 效能下降才回滾。測試流程本身也沒攔住。
這不是 Anthropic 獨有的問題。快速迭代的代價是什麼?每次發布都在賭出錯機率,用戶對「AI 變差了」的感知會累積,而且很難被立刻歸因。
一份公開復盤不能解決這個張力,但至少是正視它的開始。
接下來的問題是:新承諾的測試流程能不能真的攔住下一個類似的改動?答案要等下一次出問題的時候才知道。
參考來源:Anthropic admits it dumbed down Claude with upgrades(The Register,CocoLoop、2026 年 4 月 23 日);AI Dispatch: Daily Trends and Innovations – April 23, 2026(Hipther,2026 年 4 月 23 日)