跳到正文
AYi· @AYi_AInotes · X·· 1 小时前AI 评分38
AI 导读

国内两家大厂同日传出AI人事异动:某大厂从硅谷挖来的后训练负责人入职不到一年即被边缘化、手下仅剩几人,面临离职;北京某电商巨头则开出八位数千万级年薪,疯抢能掌管万卡集群、跑过万亿参数的底层 AI Infra 一号位。推文认为大模型竞争已从算法微调转向万卡集群调度与分布式通信的重工业消耗战,真正稀缺的是踩过万卡规模调度坑的工程老兵。

正文

刚看到国内两家大厂AI方面的新闻,感觉国内AI领域正在发生一场大模型行业最魔幻、也最残酷的权力与技术大迁徙。
一边是知名大厂从硅谷重金挖来的后训练负责人,入职不到一年就传出被彻底边缘化、手下只剩几个人,甚至面临黯然离职,
另一边是北京某电商巨头直接砸出八位数的千万级天价年薪,满世界疯抢能够掌管万卡集群、跑过万亿参数的底层 AI Infra 一号位。
这两条看似毫不相干的人事异动在同一天撞在一起,
把过去两年国内大厂在 AI 军备竞赛里交的几百亿学费,以及接下来真正的战场转移,彻底扒得一丝不挂。
为什么后训练的大科学家在内部节节败退,而底层的 Infra 架构师反而被捧成了千万年薪的座上宾?
在很多外行人的理解里,总觉得搞大模型最值钱的是那些在顶层研究算法微调、做对齐策略的天才研究员;
但真正下过工厂车间的人都知道,大模型竞争早就脱离了写论文的作坊阶段,演变成了一场极其野蛮的重工业消耗战。
后训练调算法,就像在赛车出厂前去微调悬挂和尾翼,
而 AI Infra 搞的是万卡集群的发动机制造、千亿参数的通信拓扑和成千上万张显卡在连续跑几个月时不宕机的电力底座。
如果你的地基根本稳不住,显卡跑三天崩两次、通信堵塞把算力白白烧在等待上,
那么空降再多硅谷神仙,在没有算力吞吐支持的环境里,也只能沦为巧妇难为无米之炊的摆设。
大厂的耐心是以月为单位计算的,
当算法大牛受制于底层算力和业务壁垒拿不出惊艳跑分时,组织的冷酷机器就会迅速将他架空。
而电商大厂开出千万年薪狂抢 Infra 一号位,说明巨头们终于在被现实毒打之后彻底清醒了:
在这个时代,真正能决定一家公司生死存亡的稀缺资产,
不是那些满天飞的算法公式,而是全行业屈指可数、真正肉身踩过万卡规模调度大坑、能把每天几百万电费稳稳转化成有效算力的工程老兵。
算力即权力,工程即命脉。
大模型上半场的个人英雄主义神话正式宣告破产,
下半场属于那些坐在服务器机房深处、用万卡集群和分布式通信筑起工业长城的硬核做事人。
未来两到三年,大模型领域最不可替代的核心人才,是懂前沿算法的科学家,还是懂万卡调度的 Infra 架构师呢

来源:AYi · x.com