【文/ 观察者网 心智观察所】 DeepSeek的注意力机制算子负责人刘胜与的一篇名为《我不得不把才华埋葬在昨天》的文章,最近引发广泛关注。有评论说:“以 DeepSeek 为代表的国产大模型开始反击 Anthropic 了。出手的不是公关部,是一个工程师。”还有评论认为:“一个正在被自己参与打造的技术淘汰的人,凌晨两点坐在那儿,想的不是怎么保住自己的位置,而是怎么把火种交出去。这种浪漫主义,才是真正硬核的东西。” 此前,Anthropic发布报告,对包括DeepSeek在内的多家国产模型加以指责。这种对客户指名道姓,把用户数据拿来分析的做法,已经引起了业界的警觉,有消息指出,英伟达、帕兰提尔等合作方已经开始集体限制Anthropic的Claude的使用。 刘胜与文章的主旨是道出顶尖开发者的困境:自己编写的高性能代码正在加速人工智能的蜕变,而在未来最多1年内,自己亲手培育的系统就将在底层算法设计上全面击败自己。 自动化织机超越最灵巧的绣娘 大模型在处理人类语言时,会把文本拆解成一个个被称作词元的数字单元。每一次推导答案,都是海量数字矩阵之间的庞大运算。在这场庞大的数学交响乐中,最为关键的指挥家之一就是注意力机制算子。它负责决定模型在阅读一句话时,究竟该把眼光重点聚焦在哪个词上,从而理解复杂的语义关联。 算子编写的质量,直接决定了整个超级计算集群的效率。在过去,能够为图形处理器手写核心算子的人,是整个科技工业界极其稀缺的珍贵头脑。当工程师凭借极高的抽象思维和耐性,设计出超越芯片大厂官方水平的自研算子时,那种兴奋感就像极客玩家在严苛的游戏规则下完成了打破世界纪录的极速通关。刘胜与正是这样一位能够驾驭微观指令的工匠,DeepSeek最新版本模型的核心注意力机制算子,便出自他手。 曾经需要顶级工程师枯坐整个下午、反复抓耳挠腮才能找出的细微瓶颈,如今正被人工智能以不可思议的方式攻破。仅仅用了1年左右的时间,智能辅助工具就已经从只能查阅文档、修改拼写错误的小助手,进化成了能够自主通读底层流式汇编代码、自动利用专业剖析工具定位流水线停顿点,进而独立完成性能重构的代码大师。 面对这种近乎残酷的进化速度,置身其中的从业者感受到了前所未有的心理冲击。刘胜与在文章中打过极为精妙的比方:倘若你精通织毛衣的技艺,尤其擅长各种复杂纹样的编织和精妙色彩的搭配,你织出的毛衣远近闻名,十里八乡的人都带着重金排队请你定制。你十分享受坐在窗前,沏上一壶清茶,看着窗外的远山与炊烟,安安静静引针穿线度过一整个下午的慢时光。突然有一天,有人发明出了一台神奇的机器,只要喂入毛线和图纸,机器就能以远超人类的速度织出同样完美甚至更为精巧的衣物。你深知只要自己换上机器,凭借过去20年积攒的审美与见识,依然能比别人用得更好,饭碗并不至于被打破,但那份临窗听雨、手中捻线的匠人清欢,终究被机械的巨大轰鸣无情碾碎。 而算子工程师把代码写得越极致,新型底层模型的训练与推理成本就会越低,模型参数规模膨胀得就越快,其综合智力水平与编程能力也会以指数级飙升。这是人类历史上极其少见的职业图景:从业者明知前方是自我退场的深渊,却依然在为脚下的滑轨涂抹润滑油。 面对这样的两难,为什么顶尖工程师依然选择毫无保留地优化算子?刘胜与给出了自己的答案。一方面,探寻算力极限所带来的多巴胺分泌极其纯粹,破解世界级工程难题的自豪感让工程师欲罢不能。另一方面,在浩浩荡荡的全球科技竞赛面前,个体选择原地躺平或者消极怠工根本毫无意义。即便自己停下脚步,其他实验室研发的模型依然会日夜兼程地向前狂奔,最终还是会跨过地平线将旧工种淘汰。假使某种革命注定无法逆转,亲手革掉自己业务能力的人是自己,至少保全了身为探索者的尊严。 在技术范式迁移之后,过去那种人脑直接推演微观硬件状态的浪漫工匠时代正在缓缓落下帷幕,取而代之的是由各类自动化测试套件与底层模型协同驱动的智能体。工程师必须走出微雕工坊,穿上厚重的外骨骼,转型成为驾驭智能体的机甲驾驶员。过去那种个人兴趣、自身特长与商业市场需求高度契合的黄金时代宣告结束,为了留在时代的牌桌上,人们必须把昨天的才华封存起来,去适应那个手中多了机械齿轮、心中却少了灵动节拍的全新生产模式。 被敲响的黑盒警钟 就在个体开发者为手艺的黄昏感伤之时,全球工业界的顶层结构也正在发生一场关于控制权的剧烈地震。来自美国知名科技媒体《The Information》的深度调查显示,英伟达、帕兰提尔等掌握着全球算力动脉、顶级情报分析与国防关键技术的巨头,近期正严密收紧内部人员对Anthropic旗下Claude系列前沿模型的调用权限。 Anthropic在其最新版本的前沿模型中推行了默认保存30天用户交互提示词与输出结果的机制,若触发安全风险警报,相关数据甚至可能被封存长达2年。服务提供方给出的理由看似充分:单次看
发表评论