DeepSeek核心工程師長文:我不得不將才華埋葬在昨日
Blockbeats原文編譯:華爾街見聞
DeepSeek工程師、前北大未名超算隊隊長劉勝宇寫道:「人類在毀滅自己這件事上,從未猶豫過。」他把核心(kernel)優化得越好,新模型的推理和訓練就越快;模型能力進展越快,AI取代人類寫核心的日子就越近。但他澄清,這不是失業焦慮的宣洩,而是對「手寫程式」手工業時代的莊重告別。9月14日,剛為DeepSeek V4.1交付核心kernel的年輕工程師劉勝宇,以長文《我不得不將才華埋葬在昨日》在國內外科技圈爆紅,記錄技術變遷與個人心路歷程,引發關於AI時代開發者命運與技術演進的廣泛討論。
#我不得不將才華埋葬在昨日#也登上知乎熱搜榜首。

作為大模型底層的核心建構者之一,DeepSeek機器學習系統工程師劉勝宇的技術履歷十分亮眼。他是北京大學2021級計算機科學「圖靈班」成員,曾擔任北大未名超算隊隊長,代表學校參加SC23國際大學生超算競賽。2025年4月加入DeepSeek後,他承擔了關鍵的底層kernel開發工作,並在幾天前剛完成DeepSeek V4.1主Attention kernel(head dim = 512的MQA注意力)的代碼交付。

劉勝宇在文中坦承,雖然為DeepSeek V4.1核心kernel的成功感到自豪,但也深知技術演進的不可逆。
「再過半年或一年,AI寫出來的kernel,大概率會和我寫得一樣好,甚至超過我。」劉勝宇直言,「AI每秒能處理300個token,半秒鐘敲出一條指令,二十秒寫出一段程式碼,但我不能;AI能在模型深度、思考強度、工具調用量甚至並行度上不斷提升,但我不能。」
這種快速演進,把開發者推入一個深刻的技術悖論:開發者把kernel優化得越好,新模型的推理和訓練就越快;模型能力進展越快,AI取代人類寫kernel的日子就越近。
面對這種不可阻擋的趨勢,劉勝宇寫道:「人類在毀滅自己這件事上,從未猶豫過……當然,我希望自己不會被推翻,但如果一定要被推翻,我希望推翻我的人是我自己。」
「我不會失業,但我必須轉行」
針對外界對程式設計師生計的擔憂,劉勝宇給出了清醒的判斷:工程師群體不會真正「失業」,但必將經歷一場深刻的「轉行」。
「轉行意味著我需要放棄自己長期耕耘且熱愛的kernel設計、編寫與優化領域,轉而成為Agent的『機甲駕駛員』。」他寫道,「以前,我的興趣、擅長和行業需要基本是對齊的;現在,行業的需求從『能寫高性能kernel的人』變成了『能更快地用AI產出高性能kernel的人』。」
他把這種手藝的失落,比喻為自動織襪機的出現對老工匠的衝擊。即便過往經驗仍能讓他最善用機器,但「臨窗聽雨、穿針引線、慢度時光的樂趣,終究被機器的轟鳴碾碎了」。
「我的手上多了齒輪,心裡卻少了節奏。」他感嘆。
除了個人的職業轉向,劉勝宇也對年輕一代工程能力的退化表達了擔憂。如果學生普遍依賴AI在幾分鐘內完成複雜的程式作業,未來可能在系統架構與抽象設計能力上出現斷層。「一個工程能力很差的人,配上AI,能以數倍於以往的效率產出義大利麵式程式碼,從而在系統中埋下各種隱患,讓世界變得更加混亂。」
澄清初衷:對「手工業時代」的莊重告別
由於文章發布後,在各平台引發了關於地緣政治、機構競爭乃至失業焦慮的過度解讀,劉勝宇隨後發布補充說明,澄清自己的寫作初衷。
他表示,這篇文章不是生計焦慮的宣洩,也無意挑起DeepSeek與Anthropic等閉源機構的對立,其核心動機只是對過去「純手寫kernel」的純粹時光,做一次鄭重的告別。

「想必未來某一天,『手寫kernel』甚至『程式設計』會成為一種娛樂活動而非生產活動,就像現在幾乎沒人用長矛狩獵,而是把它當作競技運動。」劉勝宇寫道,「這就相當於逼我放棄曾經熱愛的東西,強行轉向另一個方向。即便新方向同樣迷人,這種感覺並不好受。正如標題所說:我不得不將才華埋葬在昨日。」
關於為何堅持留在DeepSeek,劉勝宇重申了自己的信念:最前沿的智慧,應該以開放、普惠的方式供給社會,避免核心能力被極少數商業寡頭完全壟斷。
「在不得不將才華埋葬在昨日之後,我仍有明日之光可追。」他在補充說明結尾表示,將繼續投身於引入AI Agent寫kernel的新進程,擁抱新技術工具的同時,在新時代尋找立足之地。
原文如下:
前幾天,DeepSeek v4.1發布,將小模型能力的高度又向上推了一截。
AI發展的速度,已經遠超所有人的預期。從最初只能進行簡單對話、上下文長度僅有幾千token的ChatGPT,到具備推理能力的OpenAI o1、DeepSeek R1、Kimi K1.5 Thinking,只用了短短兩年;從推理模型到如今能在各種harness工具中流暢執行指令、完成複雜任務的智能體,也不過一年半。很難想像一年、兩年、三年後的AI會是什麼樣子——會有多強大,是否已經具備自我進化的能力,是否已經深度滲透到具身智能等領域。
AI寫kernel的能力越來越強
AI在我所從事的kernel設計與編寫領域,同樣進展神速。短短一年,它就從只能幫我查文檔、讀程式碼、找bug的小助手,變成了能獨立閱讀CUDA、PTX、SASS程式碼,透過專業工具分析每條指令的stall時間,進而獨立優化kernel的kernel高手。我相信在不久的將來,它還將具備獨立設計kernel調度、評估不同調度方案性能,並進行實現與優化的能力。
當然,我為DeepSeek v4.1的成功感到自豪——畢竟它的主Attention kernel[1]全部由我編寫,它的優秀是對我kernel的肯定。但時代的車輪滾滾向前,沒有人能阻擋技術的發展。我很清楚,再過半年或一年,AI寫出來的kernel,大概率會和我寫得一樣好,甚至超過我。AI每秒能處理300個token,半秒鐘敲出一條指令,二十秒寫出一段程式碼,但我不能;AI能在模型深度、思考強度、工具調用量(與環境交互的頻率)甚至並行度上不斷提升,但我不能。
人類在毀滅自己這件事上,從未猶豫過。為什麼明知「我kernel寫得越好,我們新模型的訓練和推理就越快,模型能力進展就越快,我被取代的日子就越近」,我仍然選擇盡可能地優化kernel?一方面,確實是因為寫kernel對我來說就像打遊戲,能帶來極大的快感。發明一個新技巧、看到自己kernel性能提升的那一刻,我的興奮不亞於速通玩家打破自己過往紀錄。同時,看到自己kernel的性能遠超廠商官方kernel時,我也會感到極大的自豪。但更重要的是,即便我「摸魚」甚至故意破壞模型訓練,其他公司的模型依然會繼續發展,最終照樣把我幹掉。「當然,我希望自己不會被推翻,但如果一定要被推翻,我希望推翻我的人是我自己。」當所有人都如此執著於毀滅自己時,我也別無選擇,只能加入這場殘酷的軍備競賽。
那我呢?
當AI寫kernel的能力真正超越我的那一天到來,那時的我會怎樣?
我的判斷是:我不會「失業」,但我必須「轉行」。生計仍可保全,但這可能意味著我再也沒有機會從事自己曾經熱愛的工作。
我曾對時代的變遷和個人未來的處境做過一個判斷:因為時代變化太快(上文提到的AI發展就是很好的例子),我無法預測五年、十年後會發生什麼,但無論如何,我相信憑藉自己的眼界、判斷力、主動性和聰明才智,能夠留在時代的牌桌上,再次站到前沿。然而,這個判斷只能保證我不會「失業」,不能保證我不需要「轉行」。或者說,這個判斷恰恰是在鼓勵我透過轉行來避免失業。
那麼,轉行意味著什麼?意味著我需要放棄自己長期耕耘且熱愛的kernel設計、編寫與優化領域,轉而成為Agent的「機甲駕駛員」。以前,我的興趣、擅長和行業需要基本是對齊的;現在,AI把我擅長的東西變成了它更擅長的東西,並把行業的需求從「能寫高性能kernel的人」變成了「能更快地用AI產出高性能kernel的人」。為了適應行業的需要,我必須放棄曾經熱愛的方向,轉向未知的新方向。我相信憑藉自己對工程、上層模型需求和底層硬體的理解,依然能高品質、高效率地產出kernel。我也知道自己可能會愛上這個新方向(也可能不會),但熱愛被奪走的感覺確實不好受。坐在工位上安安靜靜寫一下午kernel的寧靜喜悅,或許將在這個夏天成為絕響。我不得不將才華埋葬在昨日,成為機甲駕駛員。我的手上多了齒輪,心裡卻少了節奏。
打個形象的比方:你擅長織毛衣,尤其擅長編織各種花紋、搭配色彩。你織出的毛衣品質上乘、設計美觀,遠近的富人都來請你織毛衣,收入頗豐。同時,你非常享受坐在窗邊,泡一壺茶,看著窗外的青山綠水、牛羊炊煙,安安靜靜織一下午毛衣的感覺。但有一天,有人發明了一種神奇的機器,只要給它毛線和圖案,就能自動織出品質和質感不亞於你手工編織的毛衣,而且速度遠快於你。你很清楚,你的同行們憑藉這台機器,很容易就能達到你曾經的水準,所以你也別無選擇,只能使用它。你也知道,憑藉自己二十年積累的織毛衣手藝,即便人人都有機器,你的速度和品質依然能超越同行。但臨窗聽雨、穿針引線、慢度時光的樂趣,終究被機器的轟鳴碾碎了。
我知道這很無奈,但也沒有辦法。生計可以保全,但舊日的熱愛大概率只能放棄。我是一個理性與情感分得很開的人;需要理性處理問題時,我可以非常理性,但有時也會流露出感性的一面。記得搬離住了一年的出租屋時,我痛哭流涕,捨不得過往的回憶。今天告別手寫kernel、人腦優化的時代,無疑比那更加殘酷。
不知道有沒有讀者有類似的感受,但我覺得,也只能這樣了。
那人呢?
在AI不斷進步的同時,我也對一些問題感到擔憂:
· 現在的學生是否更傾向於用AI完成作業,尤其是實踐性強的實驗課?試想有兩個選擇:一個是花八個小時痛苦地完成實驗,可能還拿不到滿分;另一個是打開一個AI模型,以幾美分、幾分鐘的成本,讓AI寫出滿分程式碼。大多數學生會選哪個?
· 上述情況會導致大量學生工程能力嚴重缺失,包括組織程式碼、建構系統、思考未來潛在需求並在設計中提前應對、抽象化等能力。那麼,隨著AI能力不斷增強,這些「工程能力」是否還有必要?這些工程能力會像「熟練書寫x86彙編」的舊能力一樣,逐漸被時代拋棄,還是會像「理解從軟體到系統到硬體的整個電腦系統」的能力一樣,永遠有價值?如果是後者,那就危險了——一個工程能力很差的人,配上AI,能以數倍於以往的效率產出義大利麵式程式碼,從而在系統中埋下各種隱患,讓世界變得更加混亂。
· 未來的社會,權力是否會比技術或智慧更重要?
這些問題,或許需要時代自己來回答。
結語
隨著AI的發展,未來社會可能趨向兩個極端:共產主義和賽博朋克2077。前者生產力極大解放,人民生活水準顯著提高;後者少數科技公司掌控大部分資源,只有極少數人能用上最先進的AI和各種技術,達到接近「機械飛升」的效果,而大多數人只能用上很弱的AI。階級流動將越來越困難:你必須先擁有最強的AI才能跨越階級,形成惡性循環。
猜猜看,如果An****pic公司永遠掌握著世界最先進的AI,未來社會會變成共產主義還是2077?猜猜看?所以,我依然認為,最前沿的智慧,應該以開放、廉價的方式供給每一個人。我不相信Anthropic或OpenAI能做到這一點,尤其不希望Anthropic掌握最先進的人工智慧或AGI。誇張點說,其嚴重性不亞於希特勒在盟軍之前獲得原子彈技術。這就是我選擇並堅持留在DeepSeek的原因:我們研究強大、快速、普惠的人工智慧並將其開源,或許能把世界從2077的結局拉回來。
願未來世界安好。願一切美好都被祝福。
[1]「主Attention」僅包含head dim = 512的MQA注意力,不包含用於選擇top-k重要token的indexer;那部分由其他(同樣很強的)同事(以及他們的AI Agent)編寫。
關於《我不得不將才華埋葬在昨日》的補充說明
這篇文章這次爆火,微信公眾號閱讀量超過十萬,登上知乎熱搜榜首,在X上也引發了不少討論。
這波熱度著實出乎我的意料,但遺憾的是,大家的關注點並不完全與我想表達的內容一致。
我寫這篇文章的初衷,不是表達失業焦慮,也不是強調DeepSeek的開放包容與Anthropic的不討喜,而是告別我手寫kernel的時光。在Agent出現之前,我的大部分程式碼都是一個字元一個字元敲出來的。這個看似枯燥的過程,對我來說其實是一種享受:我能靜下心來,仔細思考每一個細節,從模組組織、功能佈局到程式碼邏輯、變數命名。我也享受絞盡腦汁研究kernel調度與優化方案、提升kernel性能、最終擊敗公認實現(如Flash Attention、NVIDIA官方kernel,甚至一些此前公認「不可能優化好」的任務,如token級稀疏注意力)的過程——「發明一個新技巧、看到自己kernel性能提升的那一刻,我的興奮不亞於速通玩家打破自己過往紀錄。」但現在,這種快樂正在被AI奪走:為了生產效率和kernel性能(現在的AI比我快,未來的AI既快又好),我必須擁抱新時代的新事物,研究如何更好地用AI寫kernel,工作時間裡再也沒有機會享受安安靜靜、慢慢寫、慢慢調、慢慢優化kernel的樂趣。想必未來某一天,「手寫kernel」甚至「程式設計」會成為一種娛樂活動而非生產活動,就像現在幾乎沒人用長矛狩獵,而是把它當作競技運動。這就相當於逼我放棄曾經熱愛的東西,強行轉向另一個方向。即便新方向同樣迷人,這種感覺並不好受。正如標題所說:我不得不將才華埋葬在昨日。
我是一個看重回憶與情感價值的人,但回憶會褪色,會被時間的細雪逐漸掩埋。我之前寫過另一篇文章:2025年終總結(二):記憶。因此,這篇文章其實是對自己過去時光的一次總結與懷念。我希望用這篇文章定格那些手寫kernel的畫面,把這份真實的記憶與真摯的情感保存下來,留待十年、二十年後的自己回味。順便,也用這篇文章給自己勇氣,放下過去,拿起新工具,勇敢地走進新時代。

↑ 我很喜歡的一段話,摘自公眾號評論區
但大家的理解似乎與我的初衷偏差頗大……原本文章的最後兩節只是隨筆:倒數第二節簡單提了一些AI帶來的社會問題,但並未詳細分析與解答;最後一節是我近期的一些零散思考,認為前沿智慧仍應「以開放、廉價的方式供給每一個人」。但由於我不是歷史、社會學等人文學科的專家,這部分只是簡單談了談就帶過了(順便踩了一腳我從來不喜歡的A/),其中關於共產主義與2077的辯論也未必正確。雖然「我選擇DeepSeek的原因之一是不想讓世界變成2077的樣子」和「願一切美好都被祝福」這兩句話是真的——這確實是我的理想——但它們不是這篇文章的中心。這一段也只代表我個人的觀點,不代表我所在任何公司的立場。或許未來某一天,等我把這個問題想得更清楚,會再寫一篇文章專門談它。
結果,這篇文章發布後,雖然確實有不少人對我的懷舊之情產生共鳴,但大多數人把聚光燈打在了最後一段。知乎的高讚回答還算靠譜(說明知乎用戶的閱讀理解能力相當不錯),但微信公眾號評論區裡,大量人在討論Anthropic和DeepSeek對開放智慧的態度,小紅書上甚至出現了「DeepSeek反擊Anthropic」之類的回答……我對某些新聞系同學的炒作能力深感佩服,看完之後頗感無奈……大家還是多關注文章的主題吧。
回到主題,未來AI一定會繼續變強:即便侷限於當前的Agent + Harness + 長上下文 + CoT範式,隨著資料品質、模型深度、上下文長度的持續scale,AI的能力也會穩步提升。更不用說具身智能、RSI以及我們尚不知道的技術還在前方等待。我對未來AI的能力感到樂觀,對自己在未來社會中的位置相對樂觀,但對未來的人們是否還能靜下心來認真做一件事感到悲觀,對自己能否長期把一件事既當工作又當愛好感到悲觀。
但即便如此,我依然會堅持寫kernel,並不斷引入AI Agent來寫kernel。第一,因為「當然,我希望自己不會被推翻,但如果一定要被推翻,我希望推翻我的人是我自己」(被別人淘汰不如自我進化);第二,因為我依然希望我們(或其他同樣秉持開放共享理念的AI公司)能在某些公司之前,創造出最強大的智慧,造福每一個人。我依然相信自己在共產主義與2077問題上的原始論證,希望世界能盡可能遠離2077的結局。愛好與興趣是一回事,理想與信念是另一回事,所以我會繼續在這個領域開拓。未來,我也會嘗試重新對齊愛好、特長與時代需要的方向,努力在AI時代找到屬於自己的樂土。在不得不將才華埋葬在昨日之後,我仍有明日之光可追。被世界末日的冷雨淋濕之後,我仍會用一顆溫熱的心驅散陰霾,去尋覓跨越黑夜後漸變的藍色陰影[1]。
[1] 改編自COP《世界末日的歌手》等歌曲的歌詞。
以上內容僅用作資訊或教育之目的,不構成與BTCC相關的任何投資建議。 BTCC竭力但無法保證上述全部內容的真實性、準確性和原創性。