一个刚把DeepSeek V4.1主Attention算子交出去的人,写下了一份自白。他叫刘胜与,北大超算队队长,手里握着DeepGEMM和FlashMLA核心算子。站在底层算力刀尖上的人,亲口承认自己要被革命——这句话的分量,比网上任何一句骂战都重。
全网和外媒都在疯转那句把Anthropic比作希特勒拿到核弹的暴论。但大多数人看错了重点。地缘骂战只是这篇长文最容易被消费的糖衣,真正的分量,是一个顶级工匠给所有脑力劳动者递出的冰冷尸检。
![]()
那条不可逆的加速回路
真正让人刺痛的,是他笔下那条闭环。算子优化得越极限,模型推理与训练就越快;模型越强,写底层CUDA、PTX、SASS的水平就越高;最终结果是AI越早学会改写自己的引擎零件。
这条回路一旦转起来,自己停手没有任何意义。因为对手照样加速,个体理性在集体狂飙里完全找不到刹车键。
以前工程师最骄傲的,是凭手感把GPU榨出最后一滴带宽。现在这种骄傲正在被重新定价。
被替代的不是岗位,是可目标化的手艺
算子优化之所以最先被逼入死角,不是因为它简单,恰恰相反,是因为它的成功标准太清晰了。
- 吞吐
- 延迟
- 指令停顿
- 显存带宽
这些全是可以被量化的数学指标。凡是能被写成清晰目标函数的领域,机器迟早能刷到极限。真正还能留在人手里的,暂时只剩那些只能凭手感判断的架构取舍与战略容忍。
他的判断很直接:凡是能被写成目标函数的手艺,都会在一年内被模型接管。
饭碗保得住,节拍被碾碎
比较克制的一点是,作者通篇没有哀叹自己会失业。在工业界,他依旧是稀缺的高薪核心。
但他必须被迫转业。从窗边听雨织毛衣的专注匠人,退化成给一堆Agent验收代码、防止草台班子堆砌屎山的机甲驾驶员。
巅峰与过时撞在同一年。擅长、热爱与工业需求的三者对齐,被彻底撕开了。这比失业更难受——你还在牌桌上,但你已经不是那个发牌的人。
该看清的方向
与其跟着外媒去吵开源与闭源谁才是正义,不如看清技术齿轮压过来的真正方向。
模型迭代不会停,算力效率会越来越高。当你的日常工作也能被系统拆解成一组明确的目标函数时,你早晚也得面对刘胜与当下的困境。
以后评判一个人是否被替代,可能不再看你的工位还在不在,而是看你究竟是在享受创造的节拍,还是仅仅在替机器做疲惫的品控。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.