Llama 4 输在自家 CTO 的一句话上
胡新宇
Published on 2026-07-09
Bosworth 在 Big Technology Podcast 首次复盘 Llama 4 掉队:Llama 3 透支下一代研究,143 亿抢 Alexandr Wang、追踪员工键盘轨迹——Meta 的研发管线到底断在哪里?

Llama 4 输在自家 CTO 的一句话上
2026年7月8日,Big Technology Podcast 放出 Meta CTO Andrew Bosworth 的访谈。
47 分钟里,他亲口把 Llama 4 掉队的原因摆在了台面上。
一句话概括:"为了 Llama 3 出头,我们把 Llama 4 的粮种全吃了。"
这不是技术问题,是"赢太狠"的反噬
过去一年,所有人都在问同一个问题:开源王者的 Llama,怎么突然哑了?
社区给出的答案五花八门——算力不够、对手太卷、人才流失、评测作弊。Meta 自己也只是反复强调"还在迭代"。直到 Bosworth 在播客里把盖子揭开:
"我们在交付 Llama 3 时,几乎把手头所有的研究成果都投了进去。我们动用了能动用的一切资源,结果无意中掐断了后续的研发管线。"
Llama 3 之所以能成为"广受好评的好模型",不是因为 Meta 的研发体系成熟到可以稳定输出顶级模型,而是因为团队把下一代本来要用的所有前沿设想——推理、混合专家(MoE)、对下一阶段路线的所有探索——一次性预支给了这一个版本。
Llama 3 是赢了。Llama 4 的研发管道,也跟着空了。
Llama 3 是一次"赢太狠"的反噬。
Meta 的研发体系一直跑两套并行机制:一部分人在现有基础模型上做渐进式改进,另一部分人在外头探索全新路线。Llama 3 这一版"两帮人一起上"的打法,让做 Llama 4 的人手空了,探索路线断了,于是推理落后、MoE 落后、一堆支撑行业进步的关键技术都落后。
Bosworth 用了那个科技圈里不太愿意公开承认的词——"管道空空如也"。

红色节点表示被透支的探索性研究,橙色表示断档起点,灰色表示实际落后,蓝色表示补丁(Muse Spark)。
为什么 Llama 3 必须这么打?
看到这里的人很容易接一句:"那 Meta 是傻吗?为什么要这么打?"
回看 2024 年的局面:Qwen、DeepSeek、Mistral 一路追赶,开源对闭源第一次有了真正叫板的资本。Meta 的算力不弱,团队也不差,但 Llama 2 的市场反响明显落后于 OpenAI 和 Anthropic 的闭源方案。Meta 当时的选择只有两个——要么继续按部就班走渐进路线,要么把 Llama 3 当作"决胜局"来打。
他们选了后者。
Bosworth 用了"创始人模式(founder mode)"这个词,说 Mark Zuckerberg 是从 Llama 3 这一代开始切换进了一种独属于他的状态——全身心扑在为 Meta 争取所需的全部算力和全部人才。143 亿挖 Alexandr Wang 的 Scale AI 团队,是这个状态下的标志动作。
但这种"创始人模式"本身就有副作用:创始人模式的标志是短周期、高强度、all-in。它天然会倾向于把下一代的资源提前用到这一代。
Llama 3 的胜利,是用 Llama 4 的"种子粮"换来的。
"战时动员"和键盘追踪:补窟窿的两招
Llama 4 管道空了的窟窿怎么补?
Bosworth 复盘了 Meta 用过的两招,都是外延式补法,没用"研发管线断档"这个内伤上。
