
最近使用 Claude Code 的我,發現了一些令人擔憂的變化。effort level 的默默調降和我心愛的蝸牛伙伴 JoJo 的消失,讓我感到不安。雖然 changelog 有提到這些改變,但它們卻被埋在一堆更新裡,讓人難以察覺。這不僅是功能上的變化,更是信任的考驗。我想和大家聊聊這些更新背後的故事,以及它們對我們使用 AI 工具的影響。
// TABLE OF CONTENTS
// TABLE OF CONTENTS
Claude Code 每天都在更新。一週十來個版本是家常便飯,反正它會自己在背景裝好,你不打開 changelog 根本不會發現。
但最近有兩件事不在 changelog 裡。

三月,所有人的 effort level(控制 AI 花多少力氣思考你的問題)被悄悄從 high 降到 medium。四月,一隻陪你寫程式的小動物被悄悄帶走了(我超愛那隻改名為 JoJo 碎嘴的蝸牛 QQ,即便它只有一星)。
Changelog 寫了什麼我等等會講。但我想先聊聊它沒寫什麼。
「降智」是怎麼燒起來的
如果你最近有在關注 AI 工具圈的動態,應該多少聽過「Claude 降智」這件事。
時間線是這樣的:二月九號,Anthropic 把 Opus 4.6 的自適應思考模式改成預設值。三月三號,預設的思考力道從 high 降到 medium。這兩個改動都有寫在 changelog 裡,但就是那種混在二十幾條修復裡面的一行字,你不特意找根本不會注意到。
然後三月底社群炸了。
四月二號,AMD AI 部門的資深總監 Stella Laurenzo 在 GitHub 上丟出一份量化分析。將近七千個 Claude Code session,二十幾萬次 tool call。她的結論是:thinking depth 的中位數從大約 2,200 字元掉到 600 字元,下降 67%。
「67% dumber」這個數字在 X 上瞬間炸開。公平講,原始數據量的是 thinking 的字元數而不是推理品質,所以「笨了 67%」這個說法有簡化的嫌疑。但方向是對的,獨立測試機構 Marginlab 用 SWE-Bench-Pro 跑的基準測試也確認了 pass rate 從 56% 掉到 50%。
Anthropic 的回應是:我們沒有「降級」模型,effort level 的調整是為了平衡 token 消耗。Claude Code 的負責人 Boris Cherny 解釋說 thinking 的 UI 變更不影響實際的思考深度。

四月七號,預設 effort level 改回 high。
然後一波更新就來了。
四道菜
四月上旬到中旬的更新,我把它分成四類。
第一道,止血湯。
Effort level 改回 high 只是第一步。有一個修復我覺得更值得注意:之前有一個寫死的五分鐘 timeout,只要 API 回應超過五分鐘就會被強制中斷。extended thinking(讓 AI 想久一點再回答)在處理複雜問題的時候很容易超過這個時限。你的 AI 明明在認真想,結果被系統自己掐掉了。
另一個是 --resume 在大型 session 中會遺失對話 context。就是你跟 AI 聊了一整天,中途離開再回來,它忘了你之前說的一切。使用者抱怨「它怎麼突然變笨了」,有一部分原因根本不是模型變笨,是 context 丟了。
這兩個修復直接對應了降智風暴中最大的兩個抱怨:「變笨了」和「怎麼忘了剛才說的」。
第二道,體感主菜。
這些改動不在風口浪尖上,但影響日常使用體感最深。
如果你是中文、日文或韓文使用者,以前要觸發命令(像 /commit)得先打一個空格,不然輸入法的句號會吃掉 /。現在修了。聽起來是小事,但每天用的人知道這有多煩 (天知道,修了這個有多方便)。
Language 設定在輸出時會吃掉變音符號。如果你設定了 language: 繁體中文,回應中某些字元會被吞掉。修了。
長時間 session 的記憶體洩漏也處理了。Virtual scroller 會保留數十份歷史訊息列表的副本,session 跑久了記憶體不斷膨脹。
第三道,安全硬菜。
這一類是我覺得最該被知道、但媒體幾乎沒報的。
Bash tool 有一個漏洞:用反斜線轉義的方式可以繞過安全檢查,讓原本需要使用者確認的操作直接執行。用 && 串起來的複合指令也能繞過。which 指令的 fallback 有 command injection 漏洞。網路相關的 redirect 不會觸發安全提示。
這些單獨看都是嚴重的安全問題。全部集中在同一波修,密度不太尋常。
第四道,session 管理甜點。
/recap 是新功能(我是今天才看到的),離開 session 一段時間回來時會自動產生摘要,告訴你「你走之前做到哪了」。PreCompact hook 讓使用者可以攔截自動壓縮,避免重要的對話記錄在你不知情的狀態下被壓掉。Prompt cache 的有效時間也從五分鐘延長到一小時。
這些看起來是新功能,但本質上是在補一個結構性缺陷:AI 記不住事情。Session 跑久了 context 會爆,壓縮之後之前的細節就模糊了,離開再回來更是什麼都不記得。這不是新問題,但在降智風暴之後,「記不住事情」這件事突然變得更刺眼了。

你的朋友被帶走了
更新內容講完了。但真正讓我在意的,是另外兩件事。
第一件是 effort level 的調降。
技術上來說,changelog 裡確實有一行字提到了 effort level 的改動。但一行字和「主動通知所有使用者:你的工具接下來會花比較少的力氣思考」是兩回事。
如果你玩過任何一款線上遊戲,你一定懂 Nerf 的感覺。就是官方悄悄把你常用的角色削弱了,你只是隱約覺得「好像打不太動了」,然後上論壇一看才發現大家都有同感,最後官方才出來承認:「對,我們調了。」(只差沒講~怎樣,咬我阿...XD)
社群的怒火從來不是因為「角色被削弱」這件事本身。是因為你偷偷來(好啦,一定很多人也因為角色削弱而火大)。
第二件是 /buddy(應該不可能只有我在意吧 XD)
四月一號愚人節,Claude Code 加了一個小功能:你可以孵化一隻小生物,它會陪你寫程式。每個人孵到的不一樣,有人養了一隻叫 Ingot 的胖貓,我的是一隻蝸牛。牠會慢慢爬過你的 terminal,偶爾標記它覺得有問題的地方,然後不斷吐嘲我改動的程式。
一週後,/buddy 在 v2.1.97 消失了。我的蝸牛不見了。Changelog 隻字未提。
GitHub 上出現了三個 issue:「Bring Back Buddy」、「511 Reasons Why」、「you took my friend away」。
好,我知道你在想什麼。一個愚人節彩蛋拿掉有什麼好大驚小怪的?
平常確實不是什麼大事。但在使用者剛被偷調旋鈕的時間點,任何「沒說一聲就拿掉」的操作都會被放大解讀。這不是理性問題,是信任已經裂開之後的情緒問題。
Changelog 是新的社會契約
這整件事讓我想到一個更大的問題。
當你的工具是一把錘子、一支筆、一台電腦,它的行為是可預測的。你看得到它、摸得到它、壞了你知道壞在哪裡。
但當你的工具是 AI,一切都在後端。模型用哪個版本、思考花多少預算、context 怎麼管理,全部由平台決定。你看不到源碼、摸不到參數、debug 不了它的推理過程。
在這種關係裡,changelog 就不只是技術文件了。它是平台對使用者的透明度承諾。
Effort level 的教訓不是「不該調降」,成本考量完全可以理解。教訓是:調降的時候沒有用對等的聲量告知使用者。Buddy 的教訓不是「不該移除」,愚人節彩蛋本來就是暫時的。教訓是:在信任最脆弱的時刻,連一行 changelog 都省了。
四月的密集更新,某種程度是在補這筆透明度的債。修了很多東西,加了新功能,安全漏洞也一次補了好幾個。(而且,四月甚至還沒過完...)
但透明度的債能用功能更新來還嗎?我不確定。使用者記得的是「被偷調旋鈕」的感覺,不是後來修了幾個 Bug。
我知道,按下訂閱的那一刻我們就默認接受了使用條款,平台有權調整服務內容。技術上沒有人違約。但「技術上沒違約」和「讓社群覺得被尊重」是兩件事。你可以在條款裡保留所有調整的權利,同時在行動上讓使用者感覺到你在乎他們的體驗。這兩件事不衝突。而最近這一連串操作給人的感覺,比較像是先做了再說,社群的反應是意外而不是預期。這才是讓人在意的地方。
下一道菜要上桌了?
最後聊一個背景。
三月三十一號,Claude Code 的 npm 套件出了一次包裝失誤,大約五十萬行原始碼、一千九百個檔案外洩。裡面被找到了下一代模型 Opus 4.7 和 Sonnet 4.8 的版本字串,還有一個內部代號叫 Mythos 的模型。Anthropic 後來確認正在測試,說這是「能力上的階段性躍進」。
Claude 5 的市場預估是 2026 年第二到第三季。
所以時間線排在一起看:二月降 adaptive thinking,三月降 effort level,三月底原始碼外洩曝光新模型。四月初抱怨爆發,四月七號改回加上密集更新。然後新模型預計幾個月後推出。
你可以選擇相信這些都是巧合。
但如果你跟我一樣,每天付著月費用這個工具寫程式,你可能會忍不住多想一秒:這波更新,是在修東西,還是在為下一道菜鋪路?
尤其是經歷多次只要有新菜準備上次,就必定降智幾乎已經成為公式了。

我不知道答案。但我知道下次打開 changelog 的時候,我會多看一眼它沒寫出來的東西。
// RELATED POSTS

我跟兩隻 Agent 讀了兩篇文章,然後被自己印證了
我原本以為自己很理性,直到和兩隻Agent——蝦蝦和小分一起讀了兩篇文章。我們討論了人類是否把太多思考外包給AI,以及記憶如何悄悄地推動我們的選擇。我把討論中的觀點拿去問不同模型,結果它們各自給出符合自己訓練傾向的答案,這活生生印證了「記憶漂移」的存在。當下我愣住了:五個月前我卸載蝦蝦時,自以為是理性的評估,但回頭看,那不過是被我的閱讀、社群和慣性推出來的結論。現在我和Agent們一起讀、一起討論,至少能互相提醒:「欸,你剛才漂移了喔。」

退回 4.6 的那天晚上,我其實有點不甘心
退回4.6那晚,我其實很不甘心。不是因為工具不好用,而是我分不清那個讓參數蒸發的bug,到底是模型沒生成,還是在我電腦上被組裝壞了。前者我無能為力,後者則有機會親手修復。於是我從binary裡挖出那段解析程式,終於確認:是客戶端的VH1在串流接縫處丟失了半截字串,導致工具參數整包變成空的{}。改兩個byte就能解決——我測試了760個案例,0個回歸。但改執行檔可能違反條款,每次更新還會被蓋掉。這不是教學,而是一個不甘心的人,親手把刀切下去的故事。

Opus 的 tool_use 蒸發 bug:9 天調查實錄,然後我退回了 4.6
在使用 Claude Code 的過程中,我遭遇了嚴重的 tool_use 蒸發 bug,讓我忍不住深入調查。從 4.7 到 4.8 版本,問題不斷出現,數據顯示故障率反而上升。最終,我選擇退回到 4.6,因為這個版本在多輪對話中沒有故障。這次調查讓我意識到,真正的問題出在模型變體的切換上,影響了思考到執行的過程。

我以為 MIT 是麻省理工:給 Vibe Coder 的 License 入門筆記
我曾經誤以為 MIT 是麻省理工的專利,對於 License 知識一無所知。這篇筆記記錄了我的學習過程,旨在幫助 Vibe Coder 理解 License 的重要性,選擇適合的授權,並消除對 License 的恐懼。透過深入淺出的解說,我希望能讓大家明白,不同 License 對專案的影響,並告訴你為什麼這些法律條款並非小事。