DeepSeek研究员深夜独白:亲手埋葬热爱的AI革命者困境

DeepSeek工程师刘胜宇坦言AI将超越自己,却选择用开源普惠对抗技术垄断。
DeepSeek研究员刘胜宇参与开发了顶级大模型的核心Attention算子,却在一篇深夜自白中直面了AI即将超越自身的现实。他预判再过半年到一年,AI写算子的水平将超过他本人,但他的焦虑并非来自失业,而是一种更深层的失落——从亲手雕琢代码的创造者,沦为"指挥agent的机甲驾驶员",热爱被架空。他进而将视线拉向社会:AI的未来可能是生产力的全面解放,也可能走向技术垄断的"赛博朋克2077"图景。基于此,他选择留在DeepSeek,研究并开源普惠AI,试图用技术开放对抗技术集中,让未来属于更多人。这篇文章在海外技术圈引发强烈共鸣,道出了AI浪潮下前沿从业者共有的矛盾与使命感。
一位天才工程师的深夜自白
DeepSeek研究员刘胜宇深夜发出的一篇文章,最近在海外技术圈引发热议。他曾参与编写DeepSeek V4.1的主Attention算子——这是大模型底层性能优化中最核心、最考验功力的工作之一。就是这样一位被业内视为天才的工程师,却在文章中直面一个略显残酷的命题:AI很可能即将抢走他自己的工作。
他的表达带着一种近乎悲壮的坦然:"我当然希望自己不要被革命,但如果非被革命不可的话,我希望革我自己命的人是我自己。"这句话构成了整篇文章的情绪基调,也道出了当下无数AI从业者内心的矛盾。

从被辅助到被超越的加速度
刘胜宇用亲身经历勾勒出AI能力跃迁的速度。一年前,AI在他的工作中还只是个辅助角色,帮他查文档、找bug。而如今,AI已经能读懂CUDA PTX、SASS这样的底层汇编代码,甚至能独立优化算子。
他给出了一个冷静而惊人的判断:再过半年或者一年,AI写算子的水平大概率会超过他自己。对于一个把算子优化做到极致的人来说,这不是危言耸听,而是基于对技术曲线的专业观察。
面对这样的预期,他的选择却是继续把算子做到最好。理由很现实——自己不做,别人也会做;既然这场革命躲不开,那就自己先革自己的命。这种主动拥抱变革的姿态,比被动等待淘汰多了几分尊严。

CUDA PTX(Parallel Thread Execution)和SASS(Shader Assembly)是NVIDIA GPU的两种底层指令集。PTX是一种中间汇编语言,由编译器将CUDA C++代码编译而来,具备跨硬件架构的可移植性;SASS则是最终运行在具体GPU硬件上的本地机器指令,直接对应寄存器分配和流水线调度。能够读懂并优化这两层代码,意味着工程师需要深刻理解GPU的物理执行模型,包括warp调度、共享内存bank冲突、寄存器压力等微架构细节。这是大模型性能优化链条中最底层、门槛最高的环节,通常只有极少数专家才能驾驭。AI如今能够在这一层级独立操作,是其能力跃迁的重要标志。
不失业,却可能失去热爱
文章中最触动人心的,不是失业焦虑,而是一种更微妙的失落。刘胜宇认为自己大概率不会失业,但可能会失去曾经的热爱。
他描述了一种职业身份的转变:从一个亲手写算子的人,变成一个"指挥agent的机甲驾驶员"。工作还在,但那种一行行代码亲手雕琢、与硬件底层直接对话的乐趣,或许将不复存在。
"我不得不把才华埋葬在昨天。"这句话道出了技术人在AI时代特有的困境——当工具足够强大,人的角色从创造者退化为协调者,专业能力带来的成就感被稀释。这不是能力被否定,而是热爱被架空,某种意义上比失业更让人难以接受。

文中提到的"算子"(Operator/Kernel),是深度学习框架中执行具体数学运算的基本计算单元,例如矩阵乘法、注意力机制(Attention)、归一化等。Attention算子尤为关键,它是Transformer架构的核心组件,决定了模型如何在序列中捕捉长程依赖关系,其计算效率直接影响整个大模型的训练速度和推理延迟。手写并优化一个高性能Attention算子,需要同时精通算法数学、并行计算原理和GPU微架构,是硬件与软件深度交汇处最需要创造性投入的工作。这类工作被许多工程师视为"真正在和机器对话",失去这个角色,转而成为调度AI的"机甲驾驶员",其成就感的落差是可以理解的。
两种未来:解放还是赛博朋克2077
文章最后,刘胜宇把视线从个人拉向整个社会。他认为AI可能把世界推向两个极端。
一端是生产力的彻底解放,技术红利惠及所有人。另一端则通向类似《赛博朋克2077》的图景:少数科技公司掌握最先进的AI和资源,而普通人只能使用更弱的AI,技术鸿沟固化为新的阶层壁垒。
他甚至点名了Anthropic,抛出了一个尖锐的问题——如果最先进的AI永远掌握在少数公司手里,世界会走向哪里?这一追问触及了AI时代最核心的公平性议题:技术的集中化,是否会让智能本身变成一种奢侈品。

刘胜宇点名的Anthropic是目前全球最顶尖的AI安全研究公司之一,由前OpenAI核心团队成员创立,开发了Claude系列大模型。与OpenAI和Google不同,Anthropic的模型目前并未开源,其最先进版本仅通过API付费访问,是"前沿AI能力集中在少数商业机构"这一现象的典型代表。刘胜宇以Anthropic为例并非随意,而是精准指向了AI产业中"安全对齐"话语与商业垄断倾向之间的内在张力——打着安全旗号的闭源,是否同样在加剧技术权力的不对称分配,是一个值得深究的问题。
留下来的理由:让未来属于更多人
基于这样的判断,刘胜宇的选择变得清晰:留在DeepSeek,研究强大、快速、普惠的人工智能,并将其开源。
他相信开源或许能把世界从"2077的那一端"拉回来一些。这不仅是一个工程师的职业选择,更是一种价值立场——用技术普惠对抗技术垄断,用开放对抗封闭。
"既然未来一定会来,那就尽力让它属于更多人。"这句收尾,把个人的失落转化为更大的使命感。当一个人预见到自己将被自己参与创造的技术超越,却依然选择加速这个进程,并试图让更多人分享其成果,这背后是一种超越个人得失的技术理想主义。
结语:AI从业者的集体心声
刘胜宇的独白之所以在海外火爆,正因为它说出了许多AI从业者不愿明说的心声。技术进步的红利与代价往往落在不同人身上,而站在浪潮最前沿的人,反而最先感受到被浪潮吞没的可能。
这篇文章的价值不在于给出答案,而在于诚实地提出问题:当AI足够强大,我们该如何安放自己的热爱?技术该属于少数人还是所有人?这些问题没有标准答案,但值得每一个身处这个时代的人认真思考。
相关推荐

LynnReal-Omni:32B统一视频扩散模型开源,四步生成多任务全覆盖
LynnReal-Omni 是基于 MiniMax H3 架构的 32B 统一视频扩散模型,支持文生视频、图生视频、姿态引导、视频修复等多任务,四步快速生成,Flash 版单张 H100 上 377ms 完成 540p 视频,权重与 ComfyUI 节点已开源。

Anthropic联合创始人:AI"紧急停止开关"或应强制立法
Anthropic联合创始人向BBC表示,AI系统的"紧急停止开关"(kill switch)可能需要通过法律强制推行。本文分析这一呼吁背后的产业逻辑、技术挑战以及监管与创新之间的张力。

AI数据中心建设热潮,正冲击工业创伤深重的城市
AI数据中心建设热潮正与曾受重工业创伤的城市社区激烈碰撞。以费城为例,全国性反对声浪聚焦能耗、水资源与环境公平问题,揭示AI增长与地方利益的结构性冲突。