欢迎访问深圳市中小企业公共服务平台电子信息窗口

DeepSeek工程师刘胜与《我不得不把才华埋葬在昨天》全文解读

2026-09-16 来源:电子工程专辑
92

关键词: 刘胜与 DeepSeek 我不得不把才华埋葬在昨天 解读

2026年9月14日,DeepSeek机器学习系统(MLSys)工程师刘胜与在个人平台发布长文《我不得不把才华埋葬在昨天》。文章迅速出圈:微信公众号阅读量突破10万,作者自述达到十几万的量级,词条冲上知乎热榜第一,并在X上引发广泛讨论,随后被翻译成多国语言在海外技术社区传播。

文章以DeepSeek V4.1发布为引子。刘胜与在文中透露,V4.1的主Attention算子由他本人编写,模型的优秀是对他算子工作的肯定。但他同时冷静预判:再过半年到一年,AI写的算子大概率会和他写得同样优秀,甚至将他超越。他写道,短短一年间,AI已从只能查文档、读代码、找bug的小助手,蜕变为能独立阅读CUDA、PTX与SASS编码、分析每条指令停顿时间并独立优化算子的"算子大师"——这个领域门槛极高,是AI基础设施中最硬核的方向之一。

文章的核心判断是:等到AI写算子的水平高于他的那天,他不至于"失业",但必须要"转业"——放弃深耕已久并充满热爱的算子设计、编写与优化,转而去做Agent的"机甲驾驶员"。他用"织毛衣的人面对自动织毛衣机器"作比喻:那份坐在窗边、沏一壶清茶、静静织上一下午毛衣的意趣,终究被机器的轰鸣碾碎。文章末尾,他还谈及AI带来的工程教育问题、共产主义与赛博朋克2077两种未来图景,并解释了自己留在DeepSeek的原因——相信前沿智能应以开放、廉价的方式供应给所有人。

9月15日晚,刘胜与发布补充说明,澄清文章本意并非表达失业焦虑,也不是争论DeepSeek与Anthropic的路线分歧,而是"和过去手写算子的那段时光说句再见"。他回忆,Agent出现之前大部分代码都是自己一个字一个字敲出来的,从模块组织到变量命名的细节把控、击败Flash Attention与英伟达官方算子的快感,都曾是他的快乐源泉;未来"手写算子"甚至"编程"可能像标枪一样,从生产活动变成娱乐或竞技。他表示将继续坚持写算子、并不断引入AI Agent写算子。

这篇文章为什么火了?

这篇长文的传播力,首先来自强烈的身份反差。作者不是被AI浪潮波及的普通职场人,而是刚刚亲手交付V4.1核心算子的顶尖工程师——亲手铸造AI引擎的人,在目睹模型攻入自己的专业腹地后,冷静承认自己正在加速被替代。这种"最不可能被替代的人率先给自己下判词"的戏剧性,天然具备传播张力。

其次是真实感与细节密度。文中没有空泛的宏大叙事,而是给出具体到令人窒息的对比:AI一秒能思考300个token、半秒敲出一行命令、二十秒写完一份代码,"而我不行";AI能在模型深度、思考强度、工具调用量乃至并行度上不断提升,"而我不能" 。这种一线从业者第一视角的诚实记录,比任何第三方分析都更有说服力。

金句的穿透力则直接点燃了转发欲望。"我当然希望自己不要被革命,但如果非被革命不可的话,我希望革我自己命的人是我自己",这句话被多家媒体单独摘引,被视为文章最有力的注脚;"人类在毁灭自己这件事情上,自古以来都表现得毫不犹豫"以及标题本身"我不得不把才华埋葬在昨天",都具备脱离上下文独立传播的能力。

此外,"织毛衣"的比喻把极客议题翻译成了大众语言。即便不懂CUDA和算子,任何行业的读者都能从中看到自己职业的镜像——这种"人人可对号入座"的普适性,是文章从知乎热榜一路烧到小红书、微博乃至海外X平台的关键。

当然,传播中也出现了作者本人感慨的跑偏:大量讨论聚焦于结尾关于共产主义与2077的随笔,以及DeepSeek与Anthropic的开放路线之争,小红书上甚至出现"DeepSeek反击Anthropic"式解读——这正是他在补充说明中特意澄清的部分。

作者刘胜与

根据北京大学未名超算队官网信息,刘胜与是2021级北京大学信息科学技术学院信息与计算科学本科生,曾任未名超算队队长,代表队伍出征SC23国际大学生超算竞赛。北京大学新闻网的公开报道显示,北大超算队曾获2023年SCC国际大学生超算竞赛亚军。在校期间他深入研究Transformer底层架构与CUDA编程,代表作包括与北大、UCSD合作发表于OSDI'24的大模型服务系统DistServe,以及个人开源的轻量级推理引擎swiftLLM。

2025年4月,他放弃加州大学伯克利分校与卡耐基梅隆大学的博士录取,加入DeepSeek担任机器学习系统(MLSys)工程师。在DeepSeek的技术贡献链条中,他深度参与了2025年2月DeepGEMM算子库开源中的FP8极致性能GEMM优化,参与了2026年4月DeepEP V2专家并行通信库升级,并在2026年9月独立负责DeepSeek V4.1主Attention算子的开发。

值得一提的是作者本人对细节的较真:他在原文脚注中特别说明,所谓"主Attention算子"仅指head dim为512的MQA attention,用于选出top-k重要token的indexer部分则由其他同事及其AI Agent编写。这种严谨,或许正是这位24岁工程师能在一年内站上领域之巅、又最早清醒看到浪潮方向的原因。正如他在补充说明的结尾所写:在不得不把才华埋葬在昨天后,我还有明天的光明可以追逐。