Transformer之父跳槽,AI行业要变天
导读
2026年6月18日,一条消息震动了整个AI圈。
Noam Shazeer,Transformer架构的核心奠基人,谷歌Gemini的联合负责人,正式宣布加入OpenAI,担任架构研究负责人。
这不是一次普通的人才流动。
这是一个时代的风向标。
当27亿美元都留不住一个工程师的时候,我们知道,AI行业的某种底层逻辑,正在发生变化。
今天这篇文章,我想带你深入了解Shazeer这个人,以及他这次跳槽背后的深层含义。
01 他是谁?现代AI的"地基"浇筑者
一个名字,半部AI史
Noam Shazeer这个名字,圈外人可能不太熟悉。
但在AI圈内,他是神一样的存在。
毫不夸张地说,没有Shazeer,就没有今天的大模型时代。
他的每一项重要工作,都成了现代AI的基石。
Transformer:改变世界的一篇论文
2017年,谷歌大脑团队发表了一篇划时代的论文:
《Attention Is All You Need》。
这篇论文提出了Transformer架构。
Shazeer是这篇论文的核心作者之一。
当时谁也没想到,这个最初为机器翻译设计的架构,会在几年后引爆整个AI革命。
ChatGPT、GPT-4、Gemini、Claude、DeepSeek……
今天所有你叫得出名字的大模型,底层全都是Transformer架构。
说Shazeer是"大模型时代的奠基人",一点都不夸张。
MoE:让大模型"做大"的秘密武器
除了Transformer,Shazeer还有一项至关重要的贡献——
混合专家模型(Mixture of Experts, MoE)。
什么是MoE?
简单说,就是把一个大模型拆成很多"小专家",每次只激活其中几个。
这样就能用更低的计算成本,训练更大的模型。
Shazeer是MoE技术的先驱。
早在2017年,他就发表了《Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer》这篇论文。
当时很多人觉得这是"异端"。
但几年后,MoE成了大模型做大的标配技术。
GPT-4用了MoE,Gemini用了MoE,几乎所有头部大模型都在用MoE。
Shazeer不仅发明了Transformer,还找到了让Transformer"长大"的方法。
从Transformer到MoE,他定义了现代AI的底层
Transformer解决了"怎么做好"的问题。
MoE解决了"怎么做大"的问题。
这两个技术加在一起,就是今天整个大模型产业的地基。
而Shazeer一个人,就参与缔造了这两块基石。
这样的人,全世界都找不到几个。
这就是为什么,谷歌愿意花27亿美元留住他。
02 两次出走:27亿美元也留不住的人
第一次离开:因Meena被拒而失望
Shazeer和谷歌的关系,一直有点复杂。
他2000年就加入了谷歌,是绝对的老员工。
但他的职业生涯,并不总是一帆风顺。
2021年,他第一次离开谷歌。
原因众说纷纭,但普遍认为和一个叫Meena的对话机器人项目有关。
Meena是谷歌当时的秘密武器。
Shazeer是Meena的核心开发者之一。
据说Meena的效果非常惊艳,远优于同期的其他对话模型。
但谷歌出于"安全考虑"和"产品优先级",一直没有将Meena对外发布。
Shazeer对此非常失望。
他觉得谷歌太慢了,太谨慎了,在浪费技术优势。
于是他选择了离开。
创业与回归:27亿美元的邀约
离开谷歌后,Shazeer和几个同事一起创办了Character.AI。
这是一个AI角色对话平台,后来发展得非常好。
但Shazeer没有待太久。
2023年底,ChatGPT爆火,谷歌感受到了前所未有的压力。
他们迫切需要把最顶尖的人才请回来。
于是他们向Shazeer发出了一个无法拒绝的offer——
27亿美元,邀请他回归谷歌,担任Gemini联合负责人。
是的,你没看错,27亿美元。
一个人的身价。
这可能是人类历史上最贵的工程师合同。
Shazeer接受了。
他回到了谷歌,扛起了Gemini的技术大旗。
当时很多人觉得,有Shazeer坐镇,Gemini追上甚至超越GPT只是时间问题。
第二次离开:为什么又走了?
然而仅仅一年半之后,Shazeer再次离开了谷歌。
这一次,他去了OpenAI。
为什么?
官方说法是,他想要更专注于架构研究。
但坊间有很多猜测。
有人说,是因为Gemini的进展不及预期,Shazeer背负了太大压力。
有人说,是因为谷歌内部的官僚主义和流程繁琐,让真正的技术天才难以施展。
也有人说,是因为OpenAI给了他无法拒绝的条件——不仅仅是钱,更是研究自由度和使命愿景。
真实原因可能只有Shazeer自己知道。
但有一点是确定的:
当一个人愿意放弃27亿美元的时候,他追求的,一定是比钱更重要的东西。
03 为什么是OpenAI?
原因一:AGI信仰的对齐
Sam Altman在欢迎Shazeer加入的推文中说:
"从OpenAI成立的第一天起,我就想和Noam一起工作。"
这句话分量很重。
为什么Sam Altman如此看重Shazeer?
因为他们对AI的愿景是一致的——
实现通用人工智能(AGI)。
在谷歌,Shazeer可能只是一个大型项目的技术负责人。
他的工作需要服从于公司的整体战略,需要和产品、商业、法务等各种部门协调。
但在OpenAI,他可以专注于真正的前沿研究。
OpenAI的使命就是打造AGI。
对于Shazeer这样的顶尖科学家来说,没有什么比"打造真正的通用人工智能"更有吸引力了。
信仰对齐,是最高级的对齐。
原因二:架构研究负责人的定位
Shazeer在OpenAI的职位是"架构研究负责人"。
这个职位非常有意思。
它不是某个具体产品的负责人,而是整个架构方向的负责人。
这意味着,Shazeer可以在一个更高的层面,思考下一代AI架构的方向。
Transformer已经8年了。
虽然它依然强大,但越来越多的人开始思考:
Transformer之后,下一代AI架构会是什么?
有没有比Transformer更好的架构?
这正是Shazeer最擅长的事情。
他上一次研究新架构,搞出了Transformer。
这一次,他会搞出什么?
没有人知道。
但所有人都在期待。
给最聪明的人最大的自由度,让他去探索未知——这可能就是OpenAI最厉害的地方。
原因三:梦幻组合的吸引力
还有一个很有意思的细节。
OpenAI的首席科学家Ilya Sutskever,也是深度学习领域的传奇人物。
但Ilya更偏重于学习算法和训练方法。
而Shazeer更偏重于架构设计。
如果说Ilya是"训练之王",那Shazeer就是"架构之神"。
现在,这两个人要在同一家公司工作了。
他们会碰撞出什么样的火花?
想想都让人兴奋。
两大传奇联手,可能会创造出我们想象不到的东西。
04 行业变天:从"堆算力"到"拼架构"
一个时代的结束
Shazeer的跳槽,标志着一个时代的结束。
过去几年,AI行业的竞争主要是"堆算力"。
谁的显卡多,谁就能训练更大的模型,谁就更厉害。
OpenAI靠先发优势和微软的算力支持领跑。
谷歌靠自己的TPU矩阵紧追不舍。
大家比的是谁更有钱,谁能买到更多芯片。
但渐渐地,人们发现——
光靠堆算力,边际效益越来越低了。
模型越来越大,训练成本越来越高,但性能提升越来越小。
单纯靠堆算力的时代,可能快要走到头了。
架构创新的时代正在到来
接下来的竞争,会转向架构创新。
谁能发明出更高效、更强大的新架构,谁就能实现弯道超车。
这正是Shazeer的价值所在。
他是这个星球上最懂AI架构的几个人之一。
他的加入,可能会让OpenAI在架构创新上再领先一个身位。
而谷歌,失去了自己最顶尖的架构师。
此消彼长,影响深远。
未来的AI竞争,不仅是算力之争,更是架构之争、人才之争。
对整个行业的影响
Shazeer加入OpenAI,对整个行业都会产生连锁反应。
对于谷歌:这是一次重大打击。Gemini的后续发展可能会受到影响,谷歌需要尽快找到能顶替Shazeer的人。
对于Anthropic、DeepSeek等其他大模型公司:这既是压力也是机会。压力是OpenAI又变强了,机会是谷歌流失的人才可能会流向其他公司。
对于创业公司:架构创新的重要性提升,意味着小公司也有可能靠一个好的架构idea实现逆袭。
对于整个行业:顶尖人才向最前沿的公司集中,会加速技术突破的速度。AI的发展,可能会比我们想象的更快。
一个人才加速流动、架构加速迭代的时代,正在到来。
05 更深层的隐喻:天才与体制的矛盾
一个反复出现的故事
Shazeer两次离开谷歌的故事,让我想起了很多似曾相识的情节。
乔布斯当年被自己请来的CEO踢出苹果。
马斯克和Paypal董事会的冲突。
还有很多很多——
最顶尖的人才,往往和大公司体制有着天然的矛盾。
为什么大公司留不住天才?
大公司需要流程、需要规范、需要协调。
但天才往往不喜欢被流程束缚。
大公司追求稳妥、追求风险可控。
但天才往往想要做一些疯狂的、没人做过的事情。
大公司有很多部门、很多利益相关方。
但天才往往只关心技术本身,不擅长也不屑于搞办公室政治。
当一个人的才华大到一定程度,现有的组织架构就装不下他了。
OpenAI为什么能吸引他们?
OpenAI之所以能吸引这么多顶尖人才,不是因为钱最多。
而是因为它给了这些天才三样东西:
第一,使命感。
打造AGI,改变世界,这个目标足够宏大,足够让最聪明的人心动。
第二,自由度。
让顶尖人才做他们最擅长的事,不要用流程和规则束缚他们。
第三,浓度。
周围都是和你一样聪明、一样有热情的人,这种环境本身就有巨大的吸引力。
当这些因素叠加在一起的时候,钱反而成了次要的考虑。
最好的人才,永远是用使命和自由吸引来的,而不是靠钱砸出来的。
结语
2017年,Shazeer和他的同事们发表了Transformer论文。
当时很少有人意识到,这篇论文会改变整个世界。
2026年,Shazeer加入了OpenAI。
这一次,他会给我们带来什么?
我们不知道。
但历史告诉我们——
每当Shazeer决定搞点新东西的时候,整个世界都会为之改变。
AI行业的天,可能真的要变了。
我们能做的,就是保持关注,保持学习,准备好迎接下一个时代。
参考资料:
1] [突发,Transformer之父告别谷歌,转投OpenAI - 36氪 - 2026-06-18
2] [谷歌Gemini联席负责人,被OpenAI挖了 - 凤凰网 - 2026-06-18
3] [谷歌Transformer之父跳槽OpenAI,沙泽尔究竟在想什么? - 虎嗅网 - 2026-06-18
看完了?欢迎关注我,一起探讨AI的无限可能~