
我看到林俊旸在 X 上發表的短短一句告別,心中不禁感慨萬千。他的離開不僅是個人的決定,更是整個 Qwen 團隊的損失。作為一位年輕的技術領導者,他讓 Qwen 成為全球開源模型的佼佼者,而如今團隊卻因組織調整而散落。這讓我反思大公司如何對待真正的做事者,難道他們不明白,核心人才的價值在於他們的創造力與熱情嗎?
// TABLE OF CONTENTS
// TABLE OF CONTENTS
「bye my beloved qwen.」當做事的人被送走
寫在最前面,我想先表達一下,因為我覺得現在這個紛亂的時代很容易寫了一些文章就被人家貼上標籤。會寫這篇文章主要是在感嘆這件事情的發生,所以希望不要因為這篇文章就被貼上標籤。 QQ
三月四號晚上11 點,我滑 X 看到了一則貼文(文章連結補充在最後),點進去一看,林俊旸在 X 上寫了一句話:
「me stepping down. bye my beloved qwen.」

就這樣。沒有長文告別,沒有感謝公司栽培,沒有「期待下一段旅程」。一句話,乾淨灑脫,又無限遺憾。
然後我才發現,這不只是一個人離開。早在一月,Qwen Code 負責人惠彬原就已經離開,去了 Meta。三月,後訓練負責人郁博文同日離職,核心貢獻者李凱鑫也宣布離開。整個 Q1,Qwen 的核心團隊持續失血。
32 歲的阿里最年輕 P10,帶著他一手帶起來的戰友,就這樣散了。
我查了資料才知道「P10」是什麼概念。阿里巴巴的技術職級從 P4 到 P14,P10 大概等於「資深技術總監」,整個集團幾萬名工程師裡能走到這一級的只有幾百人,通常至少要四十歲以上。林俊旸 32 歲就拿到了!!!
先講一下這個人有多猛
林俊旸的背景很有趣。北大電腦科學本科,碩士跑去讀語言學。2019 年畢業直接進達摩院,參與早期的多模態預訓練專案 M6。2020 年 Qwen 立項,他成為核心架構成員,2022 年升任技術負責人。
在他手上,Qwen 從一個 2023 年 Beta 階段的新生兒,長成全球最大的開源模型家族之一。Hugging Face 下載量突破 10 億次。衍生模型超過 20 萬個。在生態系統規模上超過 Meta 的 Llama。Google Scholar 引用超過 4.2 萬,光 Qwen3 技術報告單篇就接近 9000 次引用。
但如果只看數字,你會錯過一件很重要的事。
林俊旸讓 Qwen 有了一張人的臉。他在 X 上不是那種丟個模型連結就消失的官方帳號,而是真的會回開發者的技術問題,分享 Benchmark 的細節,參與模型架構的公開討論。全球開發者社群對 Qwen 的信任,有很大一部分不是建立在 Benchmark 分數上,是建立在「這個團隊真的在聽我們說話」的感覺上。
而那個「讓人覺得有人在聽我說話」的角色,就是他。

為什麼走?
根據中國科技商業媒體《晚點 LatePost》的獨家報導,通義實驗室做了一次組織調整。原本 Qwen 團隊是垂直整合的體系,涵蓋不同訓練流程和模態。調整之後,被拆成預訓練、後訓練、文本、多模態等各自獨立的水平分工團隊。
白話文就是:林俊旸的管理範圍被大幅縮減。
更耐人尋味的是,前 Google DeepMind(也就是做 Gemini 的團隊)的研究員周浩加入了通義實驗室,接手了後訓練的工作。阿里沒有找一個開源社群出身的人來接棒,而是找了一個大廠消費級產品背景的人。方向很明顯了。
同事 Chen Cheng 在 X 上轉發他的離職貼文,寫了一段很讓人心碎的話:「我知道離開並非你的選擇。就在昨晚,我們還並肩發布 Qwen3.5 小模型。說實話,我無法想象沒有你的 Qwen。」
你沒看錯。離職前不到 48 小時,他還在跟團隊一起發布 Qwen3.5 小模型系列。發完模型,然後告別。
開源社群的反應
Qwen 團隊的研究科學家 Wenting Zhao 說這是「the end of an era」。Hugging Face 亞太生態系統負責人 Tiezhen Wang 說這是「an immense loss」。X 上那則貼文很快就衝到上萬讚、上千則留言,幾乎全是來自全球開發者的致謝和不捨。
社群中有人擔心 Qwen3 會不會成為「絕唱」,擔心團隊從此轉向封閉商業化。
你知道嗎,我看到一個評論特別有感:「Qwen 離開了做事的人,什麼都不是。」
為什麼我特別想聊這件事
因為時間點太諷刺了。
就在林俊旸離開的不到 48 小時前,Qwen 團隊才剛發布了 Qwen3.5 小模型系列,四個版本:0.8B、2B、4B、9B。這系列模型有多猛?9B 版本在 GPQA Diamond 拿到 81.7 分,直接打贏了 OpenAI 的 gpt-oss-120B(71.5 分)。一個 9B 的模型,幹掉了一個參數量是它 13 倍的模型。
連 Elon Musk 都在社群上說 Qwen3.5 的「Intelligence Density」(智慧密度)令人印象深刻。
但讓我最興奮的不是跑分,是這東西可以在本地跑。9B 的 INT4 量化版本,顯存佔用大概 6 到 7GB,一張 RTX 3060 就能跑起來。262K 的原生上下文窗口,還支援文字、圖片、影片的多模態輸入。0.8B 的版本甚至可以在手機上跑。
我去年在開發一個寫小說用的 app,為了省 API 費用,一直在試各家模型能不能搬到本地跑。Ollama 上的模型試過,OpenRouter 上的也試過。但本地模型就是那個老問題:夠聰明的太大跑不動,跑得動的又太笨,沒辦法好好幫我寫小說。所以看到 Qwen3.5 小模型系列的時候真的很興奮,因為我知道,這樣的小型模型肯定可以在我的 Mac 上跑得非常順暢。 終於有個又小又聰明的選擇了。但轉頭就聽到做出這個模型的團隊在發布後 48 小時內散了,那個心情真的很複雜。
就好像你剛端出了一桌最好的菜,正要請廚師出來致意,餐廳就說然後廚師剛被 Fire 了。

大公司永遠學不會的事
這件事的本質,跟 AI 技術一點關係都沒有。是一個非常古老的問題:大公司怎麼對待做事的人。
阿里在 2026 年初做了一件看起來很合理的事:品牌統一。把「通義千問」精簡成「千問」,整合到阿里雲的消費級產品線。千問 APP 月活突破兩億,接入淘寶、支付寶、飛豬。春節期間還搞了「30 億請客計畫」。
從商業角度看,這完全正確。模型要商業化,團隊要跟產品線對齊,組織架構要調整。MBA 教科書寫得明明白白。
但問題是:你在調整組織的時候,把做出這個模型的靈魂人物擠走了。而且不只擠走一個,是一整群。
就在他們剛發完最新模型的 48 小時內。
我之前看過一個說法很有意思:大公司不是不知道核心人才重要,而是大公司的管理體系天生就不適合留住這種人。因為這種人要的不是更高的職級、更多的管理範圍(反而被縮減了),他們要的是「能好好做事」的空間。
但大公司的邏輯是:你做出成績了,所以你的團隊要被拆開、重組、分配到更大的戰略裡面去。你的價值已經被抽乾了,接下來需要「更專業的管理者」來「規模化運營」。
每次聽到「規模化運營」這四個字,我都會起雞皮疙瘩(不知道該哭還是該笑)。
這讓我想到什麼
我不是 AI 產業圈內人,也是在去年開始學習 AI Coding 之後,才開始想要去了解或者是關注 AI 產業圈的一些相關事情,之後才特別在意一件事情:「這個模型背後的團隊,看起來像是真的在做事的人嗎?」
這個判斷方式很不科學,但意外地準。
真的在做事的人,你感覺得到。他們的 Release Note 會寫具體改了什麼、為什麼改、還有什麼已知問題。他們的 GitHub Issue 回覆有人味,不是客服罐頭。他們會在社群裡跟開發者吵架(對,吵架也是一種在乎的表現)。
林俊旸就是這種人。整個 Qwen 團隊在他的帶領下,給人的感覺就是一群很認真在做開源的研究者。不是「公司叫我們開源所以我們開源」的那種。
所以這件事對我來說有一個很現實的重點:不要只看模型的 Benchmark,要看做模型的人還在不在。Qwen 的模型權重不會因為林俊旸離開就消失,但下一個版本的 Qwen 會不會還是那個味道,真的很難說。開源不只是把程式碼放到 GitHub 上,開源是一種態度、一種跟社群互動的方式。這個態度是人帶出來的,制度可能是無法彰顯出這樣的文化的。
最後
「bye my beloved qwen.」
我反覆看這句話好幾次。beloved 這個字選得很重。不是 my project、my work、my team。是 beloved。他把 Qwen 當成心愛的東西,然後被迫放手。
開源世界最珍貴的資源從來不是程式碼,是人。是那些半夜還在回 Issue、週末還在跑實驗、明知道可以去別的地方拿三倍薪水卻還是留下來的人,是一些可能覺得單純這件事情很好玩,想要繼續研究,想要花更多時間的人。

當一個組織開始用「組織效率」的邏輯來處理這些人的時候,就是故事要結束的時候。
也歡迎留言跟我討論你的想法。
Sources:
// RELATED POSTS

地端 AI 值不值得?九個講者給了九個答案:2026/8/19 AI 小聚心得
我參加了一場AI小聚,主題是「企業地端」,原本以為會聽到一個標準答案,結果九位講者給了九種互相碰撞的答案。有人把成本攤成試算表,有人發現硬體三個月漲七成,有人算漏了管線每一節都在收錢,也有人直接說地端不是首要重點。最讓我震撼的是臺大醫院的資訊工程師,他買GB10的理由很單純:因為對外線路被挖斷過,他不想再等35分鐘。那一晚我才真正理解,地端AI從來不是技術選擇題,而是你站在哪裡、看見什麼問題的視角差異。九個答案沒有對錯,只有位置不同。

Jackle 太變態了:七月 AI 小聚全對談心得
七月AI小聚讓我印象最深的,不是任何技術方案,而是一個畫面:每個人都在畫一條線——AI做到哪裡,人從哪裡接手。Jackle用六個Claude Max帳號、每天螢幕十八小時,一個人扛起整間公司的AI導入,甚至說Fable出來後不再請人;小馮靠矩陣合併讓六機剪片從四小時變二十三分鐘。但下半場Sunny問「起床第一件事是什麼」,又把焦點拉回人的本質。那條線每個人畫的位置都不一樣,而且一直在動。我開始反思自己的那條線畫在哪裡。

退回 4.6 的那天晚上,我其實有點不甘心
退回4.6那晚,我其實很不甘心。不是因為工具不好用,而是我分不清那個讓參數蒸發的bug,到底是模型沒生成,還是在我電腦上被組裝壞了。前者我無能為力,後者則有機會親手修復。於是我從binary裡挖出那段解析程式,終於確認:是客戶端的VH1在串流接縫處丟失了半截字串,導致工具參數整包變成空的{}。改兩個byte就能解決——我測試了760個案例,0個回歸。但改執行檔可能違反條款,每次更新還會被蓋掉。這不是教學,而是一個不甘心的人,親手把刀切下去的故事。

Opus 的 tool_use 蒸發 bug:9 天調查實錄,然後我退回了 4.6
在使用 Claude Code 的過程中,我遭遇了嚴重的 tool_use 蒸發 bug,讓我忍不住深入調查。從 4.7 到 4.8 版本,問題不斷出現,數據顯示故障率反而上升。最終,我選擇退回到 4.6,因為這個版本在多輪對話中沒有故障。這次調查讓我意識到,真正的問題出在模型變體的切換上,影響了思考到執行的過程。