前OpenAI研究员称8个月内或再迎大模型跃迁
今天,前 OpenAI 研究员(o3和Sora之父) Will Depue 发了一条很值得关注的帖子: 他最近听到的关于 OpenAI 和 Anthropic 内部研发进展速度的消息,已经到了“疯狂”的程度。
@willdepue 甚至判断: 未来 8 个月,我们可能还会看到一次类似 o3 → Fable 这种规模的能力跃迁。
并不是一个外围 AI 自媒体博主在随便猜下一代模型。他之前就在 OpenAI 做前沿模型研究,参与过 Sora 1、Sora 2,4o 和 o3 的后训练,以及 GPT-5,还带过一个研究 human-level sample efficiency 的 moonshot 团队。
更重要的是这和我们月初的时候去硅谷,听到的声音是一样的: 限制 OpenAI 和 Anthropic 下一代模型迭代速度的核心变量,现在只有算力一项了。
算法当然还重要,数据当然也还重要。但这两家公司现在最恐怖的地方,是它们已经拥有足够强的模型,开始反过来帮助自己做下一代模型了。
写代码、跑实验、生成数据、做评测、优化训练基础设施…… 整个 AI 研发流程正在被 AI 自己加速。
于是一个很可怕的飞轮开始形成: 模型越强 → AI 研发效率越高 → 下一代模型出来越快 → 模型继续变强。最后真正卡住这个循环的,可能只剩一个东西: 你到底有多少算力,可以让这个循环跑多快。
这也是为什么我越来越觉得,现在看 Gemini、Grok 和 OpenAI/Anthropic 之间这一代模型的 benchmark 差距,意义可能都没那么大了。真正应该看的,是它们内部的研发迭代速度。
如果 OpenAI 和 Anthropic 已经率先进入 AI 加速 AI 研发的阶段,那其他公司的问题就不再是下一代模型能不能追上。而是当你终于追上这一代的时候, 对方可能已经靠 AI 把下两代模型做出来了。
如果这个飞轮真的开始转起来,Gemini 和 Grok 最危险的地方,也许根本不是今天落后多少。而是可能正在被甩出这个研发循环。
我越来越觉得,大模型真正的决赛圈,可能已经开始只剩 OpenAI 和 Anthropic 了。