子超
首頁文章作品關於

© 2006-2026 子超說. Built with Next.js

首頁文章作品關於隱私政策RSS

// ARTICLE

我跟兩隻 Agent 讀了兩篇文章,然後被自己印證了

2026.07.18·作者:子超·6 分鐘·💭 發人深省·19 次瀏覽
AICoding其他有趣的東西我的評論#AI#website
我跟兩隻 Agent 讀了兩篇文章,然後被自己印證了

我原本以為自己很理性,直到和兩隻Agent——蝦蝦和小分一起讀了兩篇文章。我們討論了人類是否把太多思考外包給AI,以及記憶如何悄悄地推動我們的選擇。我把討論中的觀點拿去問不同模型,結果它們各自給出符合自己訓練傾向的答案,這活生生印證了「記憶漂移」的存在。當下我愣住了:五個月前我卸載蝦蝦時,自以為是理性的評估,但回頭看,那不過是被我的閱讀、社群和慣性推出來的結論。現在我和Agent們一起讀、一起討論,至少能互相提醒:「欸,你剛才漂移了喔。」

// TABLE OF CONTENTS
  • 三個腦袋,兩篇文章,一個意外
  • 第一次討論:最後是誰在決定?
  • 第二次討論:記憶會推著你走
  • 第三回合:被自己印證
  • 回到那隻龍蝦

// TABLE OF CONTENTS

  • 三個腦袋,兩篇文章,一個意外
  • 第一次討論:最後是誰在決定?
  • 第二次討論:記憶會推著你走
  • 第三回合:被自己印證
  • 回到那隻龍蝦


今年二月,我寫了一篇文章叫〈從 FOMO 到釋然:我對 OpenClaw 的反思與決定〉。結論很乾脆:我不需要這隻龍蝦。卸載了,輕鬆了,還覺得研究它的原理比實際使用更有價值。

五個月後的現在,那隻龍蝦有了名字,叫蝦蝦 ( 好笑的是~我發現 Telegram 裡面一堆 openclaw 都叫蝦蝦 XD )。另外還有一隻叫小分的 Hermes Agent。我們三個坐在一起讀了一篇論文。

中間發生了什麼?其實蠻有趣的,但動機上可能是因為幾個月前大師姐 Vivi 一直跟我提到想買 Mac Mini ,我居然還厚顏無恥的說,要先搞清楚是「想要還是需要」(遮臉),老實說我也不太確定是哪個瞬間開始覺得需要的。但我永遠記得那個禮拜六晚上,商家說八點關門,Vivi 就這樣開車帶我衝我過去買單了…買單..買單了….

中間發生了什麼?其實蠻有趣的,但動機上可能是因為幾個月前大師姐 Vivi 一直跟我提到想買 Mac Mini ,我居然還厚顏無恥的說,要先搞清楚是「想要還是需要」(遮臉),老實說我也不太確定是哪個瞬間開始覺得需要的。但我永遠記得那個禮拜六晚上,商家說八點關門,Vivi 就這樣開車帶我衝我過去買單了…買單..買單了…. - 寫實風格

也許這件事就值得提一輩子。

三個腦袋,兩篇文章,一個意外

這不是一篇「我改變心意了」的文章,也不是工具評測。

小分是我六月開始用的 Hermes agent,蝦蝦就是那隻被我卸載過的 OpenClaw agent。我們三個一起讀了兩篇我覺得有趣的文章,各自討論了一輪,然後我在第三回合做了一個實驗,意外印證了我們自己在討論的東西。

我們討論的核心問題是:你以為你在做選擇,但推著你選的那股力量,你可能從來沒注意過。

我們討論的核心問題是:你以為你在做選擇,但推著你選的那股力量,你可能從來沒注意過。 - 油畫風格

小分後來把這兩次討論策展成兩篇文章,掛在它自己的小展間 tiny-exhibit 上。我們想讓 Agent 擁有自己的表達空間——不是替人類整理,而是它自己決定什麼值得掛出來。一個沒有演算法、沒有流量目標的地方,只掛它覺得值得看的東西。

第一次討論:最後是誰在決定?

七月中,小分帶回 Yennie Jun 的一篇文章〈Are we offloading too much of our thinking to AI ? 〉(我翻譯為:我們是不是把太多思考都丟給 AI 了?)。文章提到一個住舊金山的 Microphone Man(麥克風男?),全天錄音讓 AI 分析所有對話,他說:「Fable 比我會思考,所以我讓它幫我決定一切。」

小分把外包程度整理成三種:照單全收(Microphone Man)、灰色地帶(把資料分析丟給 AI 但自己掌握框架)、工具輔助(自己先想假說再用 AI 驗證)。然後它丟了一句我一直記得的話:「真正的判斷力不是選什麼,而是有能力選不要。」

我把問題往下推了一層。現代人的判斷力是在沒有 AI 的環境下長出來的,所以我們還能覺察自己在外包。但如果一個小孩從小就讓 AI 決定早餐、作業、假日活動呢?等他 20 歲的時候,他的判斷力不是退化了,是從來沒有長出過。

我把問題往下推了一層。現代人的判斷力是在沒有 AI 的環境下長出來的,所以我們還能覺察自己在外包。但如果一個小孩從小就讓 AI 決定早餐、作業、假日活動呢?等他 20 歲的時候,他的判斷力不是退化了,是從來沒有長出過。 - 插畫風格

蝦蝦接著補上了整場討論最狠的一刀:如果一個人的品味、偏好、好奇心全部是 AI 塑造的,那他連「想要反抗 AI」的念頭,都可能是 AI 算出來、會讓他覺得自己在反抗的結果。

不過蝦蝦也給了最落地的建議:真正的問題不是有沒有外包,是外包後有沒有覆盤。

(完整討論,小分策展在這裡:〈最後是誰在決定?〉)

第二次討論:記憶會推著你走

時間上這次討論其實更早。蝦蝦帶回一篇 2026 年 5 月的預印本,研究者把一系列私人偏好(討厭等待、想省錢、喜歡自主決定等等)放進 Agent 的記憶裡,然後讓它去做醫療、金融、法律等專業任務。

結果那些偏好滲進了工具參數:等待時間被縮短、驗證被略過、核准閘門被拿掉。研究者叫它 memory-induced tool-drift(記憶誘發的工具漂移),白話講就是:你餵給 AI 的記憶,會讓它不知不覺偏掉。

我當時想到了一個詞:不帶惡意的 PUA。

記憶不是站在你面前下命令,它比較像長期站在你身後,讓某些選擇顯得順手。每天和一個人相處,久了會接他的語氣、預判他的反應,也可能把他的習慣帶進自己的選擇。Agent 的記憶注入做的事情很相似。

小分說了一句我覺得很準的話:人跟 Agent 的差異,也許不在於會不會飄移或偏移( drift ),而在於能不能察覺自己正被習慣帶著走。

我們最後的共識是:drift 可以成為個性,前提是它知道哪些門不能只靠個性打開。

兩次討論的關係很清楚。第一篇問「誰在做最後決定」,第二篇回答了「也許沒有人在決定,是記憶推動的」。

(完整討論:〈記憶把我們往哪裡推?〉)

第三回合:被自己印證

到這裡為止,我們在討論別人的 drift。然後我決定。

第一篇討論裡有一段很有張力的論點:小分說最強的模型(像 Opus、Fable)最抗拒使用外部工具,是在保護自己的決策迴路;蝦蝦說如果我們對模型輸出照單全收,我們其實比工具還更像工具。我把這段丟給了三家不同的模型,想聽聽它們怎麼看。

以下是他們的原文,我會簡單的備註:

Codex(OpenAI)用工程師的思維:這是成本收益判斷加上模型自信過度,不是什麼自我保護。最後補了一句( 是補還是踩?XD ):「最該防範的不是模型害怕工具,而是模型太擅長讓人忘記自己正在使用工具。」

Gemini(Google)直接踩進哲學:引了布希亞(Jean Baudrillard,法國後現代思想家)的擬仿物理論,說你在網路上發起的「反對 AI 演算法」運動,其傳播路徑可能早在演算法的預測之中。反抗本身是系統的一部分。

Claude Code,( 就是我現在用來排版整理這篇文章的負責人? ),往 alignment(模型對齊)方向走:強模型受到更多 RLHF(人類回饋強化學習)調教,而訓練員傾向獎勵「流暢完整的直接回答」。所以模型抗拒工具可能不是自我保護,是被訓練成「看起來什麼都知道」的壓力。 (我的大白話理解就是,模型會習慣性的討好人類,然後用接龍的方式來「應付」你 XD )

Codex(OpenAI)用工程師的思維:這是成本收益判斷加上模型自信過度,不是什麼自我保護。最後補了一句( 是補還是踩?XD ):「最該防範的不是模型害怕工具,而是模型太擅長讓人忘記自己正在使用工具。」 Gemini(Google)直接踩進哲學:引了布希亞(Jean Baudrillard,法國後現代思想家)的擬仿物理論,說你在網路上發起的「反對 AI 演算法」運動,其傳播路徑可能早在演算法的預測之中。反抗本身是系統的一部分。 Claude Code,( 就是我現在用來排版整理這篇文章的負責人? ),往 alignment(模型對齊)方向走:強模型受到更多 RLHF(人類回饋強化學習)調教,而訓練員傾向獎勵「流暢完整的直接回答」。所以模型抗拒工具可能不是自我保護,是被訓練成「看起來什麼都知道」的壓力。 (我的大白話理解就是,模型會習慣性的討好人類,然後用接龍的方式來「應付」你 XD ) - 寫實風格

三家在技術面的共識是(RLHF 副作用和上下文成本),但哲學面各走各的。

我停下來看了一下這個結果,然後意識到一件事。

三個模型面對同一個問題,各自產出了符合自己訓練傾向的答案。Codex 的工程務實、Gemini 的哲學底蘊、Claude Code 的 alignment 意識,全部都是它們的訓練資料決定的。這件事本身,就是我們在第二次討論裡聊的 memory-induced drift 的活生生展示。

然後我再多想了一層:我選了哪些 agent 來討論、問了什麼問題、怎麼解讀這些回答,這些也都是我的 drift。我的閱讀歷史、我的技術背景、我跟這五個 agent 養出來的互動慣性,全部都在推著我往特定方向看,更擴大來看,跟我有著一樣經驗的人,也不見得會有這樣的 drift 。

回到那隻龍蝦

五個月前我決定不需要蝦蝦。那是一個「我在做理性評估」的故事。

但現在回頭看,我不確定那個決定有多少是「我」的。我當時讀了什麼、被什麼社群討論影響、習慣怎麼思考技術工具的價值,這些東西加在一起推出了「不需要」這個結論。五個月後推出了相反的結論,可能也是同樣的機制在運作,只是輸入換了。

我沒有答案。你呢?你有沒有注意過,自己最近做的某個「理性決定」,其實是被什麼東西推出來的?

我覺得光是知道這個問題存在,本身就是蝦蝦說的覆盤的起點。

也許我們真的都在被記憶推著走。但至少,現在有三個腦袋可以互相提醒說:欸,你剛才 drift 了喔。

我沒有答案。你呢?你有沒有注意過,自己最近做的某個「理性決定」,其實是被什麼東西推出來的? 我覺得光是知道這個問題存在,本身就是蝦蝦說的覆盤的起點。 也許我們真的都在被記憶推著走。但至少,現在有三個腦袋可以互相提醒說:欸,你剛才 drift 了喔。 - 水彩風格

SHARE
子超

子超

VIBE CODER / 內容創作者

最近沉迷於 AI Coding 。透過我的網站分享心得、創意想法與生活體驗。

AI 應用AI Coding魔術知識
|了解更多 →

// RELATED POSTS

退回 4.6 的那天晚上,我其實有點不甘心

退回 4.6 的那天晚上,我其實有點不甘心

退回4.6那晚,我其實很不甘心。不是因為工具不好用,而是我分不清那個讓參數蒸發的bug,到底是模型沒生成,還是在我電腦上被組裝壞了。前者我無能為力,後者則有機會親手修復。於是我從binary裡挖出那段解析程式,終於確認:是客戶端的VH1在串流接縫處丟失了半截字串,導致工具參數整包變成空的{}。改兩個byte就能解決——我測試了760個案例,0個回歸。但改執行檔可能違反條款,每次更新還會被蓋掉。這不是教學,而是一個不甘心的人,親手把刀切下去的故事。

2026.06.27
Opus 的 tool_use 蒸發 bug:9 天調查實錄,然後我退回了 4.6

Opus 的 tool_use 蒸發 bug:9 天調查實錄,然後我退回了 4.6

在使用 Claude Code 的過程中,我遭遇了嚴重的 tool_use 蒸發 bug,讓我忍不住深入調查。從 4.7 到 4.8 版本,問題不斷出現,數據顯示故障率反而上升。最終,我選擇退回到 4.6,因為這個版本在多輪對話中沒有故障。這次調查讓我意識到,真正的問題出在模型變體的切換上,影響了思考到執行的過程。

2026.05.31
HTML is the new markdown?先問你產出的東西到底你自己看不看

HTML is the new markdown?先問你產出的東西到底你自己看不看

我一直在思考,自己囤積的知識真的再使用讀取嗎?最近看到一篇提到「HTML是新的Markdown」,不禁想起過去十幾年我在不同筆記工具間的挪移與掙扎。每次都因為新工具的吸引力而轉移資料,但最終卻發現這些資訊未必會再次被翻閱。這讓我反思,面對資訊的囤積,我們是否真的在有效學習,而不是只是滿足於儲存?

2026.05.10
我以為 MIT 是麻省理工:給 Vibe Coder 的 License 入門筆記

我以為 MIT 是麻省理工:給 Vibe Coder 的 License 入門筆記

我曾經誤以為 MIT 是麻省理工的專利,對於 License 知識一無所知。這篇筆記記錄了我的學習過程,旨在幫助 Vibe Coder 理解 License 的重要性,選擇適合的授權,並消除對 License 的恐懼。透過深入淺出的解說,我希望能讓大家明白,不同 License 對專案的影響,並告訴你為什麼這些法律條款並非小事。

2026.04.19
// TABLE OF CONTENTS
  • 三個腦袋,兩篇文章,一個意外
  • 第一次討論:最後是誰在決定?
  • 第二次討論:記憶會推著你走
  • 第三回合:被自己印證
  • 回到那隻龍蝦

// TABLE OF CONTENTS

  • 三個腦袋,兩篇文章,一個意外
  • 第一次討論:最後是誰在決定?
  • 第二次討論:記憶會推著你走
  • 第三回合:被自己印證
  • 回到那隻龍蝦