@kimmonismus 讨论OpenAI数学领域最新突破
关于OpenAI最新的数学成果公告,我有一些想法。
昨天创造了历史。我这么说毫不夸张,哪怕我自己不是数学家,因为众多数学家已经证实了这一点。领域内的顶尖专家都将这视作历史性突破。数百个数十年来悬而未决、连最聪明的头脑都在奋力攻克的难题,被OpenAI的新内部模型在极短时间内解决了。
OpenAI的代码仓库包含了722份手稿,归为372个结果系列。这里有两点尤其重要:
第一,OpenAI将此前公布的纳维-斯托克斯千禧年大奖难题解法,以及后续取得的数学成果,都归功于这个8月28日开始训练的新内部模型。OpenAI在9月的更新中描述,这个模型的能力比GPT-6 Astra强得多,并且它的性能在训练过程中持续提升。这支撑了“取得重大进展”的说法。我预计在这些公告之后,还会有进一步的提升。不过时间数据需要谨慎对待。
第二,关于纳维-斯托克斯问题,OpenAI报告称产出该结果的团队用到了大约1万个并发智能体。结果在第一批智能体启动后约88小时得出,随后又用了17小时进行Lean形式化和验证。对于这批新成果,OpenAI报告称平均计算成本大约相当于每个结果消耗ChatGPT Pro三小时的思考量。这表明,在极短时间内,效率和能力都得到了极大提升。
我确信我们现在已经进入了智能爆炸的时代。我这么说毫不夸张,而且完全确信。我们能看到它。任何有目之人都能看到,任何有耳之人都能听到。
Anthropic和OpenAI正在竞争,看谁能更快发布最大的科学突破。有一点我们应当记住:在我看来,传递出的信息是:没有墙,也看不到终点。那里工作的科学家没有一个哪怕稍微暗示过这些模型现在碰到了极限或者进入了平台期。恰恰相反:他们都说模型变得越来越快、能力越来越强。
当然,这也引发了安全问题。但这不是我今天想要讨论的。相反,我想提请大家注意两件事。
1. OpenAI现在的重心是什么?我这么说既没有恶意,也不是指责。OpenAI已经明确将打造自动化AI研究者列为一个目标。它还在2026年4月26日停用了Sora的网页和应用服务。我认为这个决定是更加聚焦的信号,不过仅靠停用一事并不能确定公司更广泛的优先级。
在这些背景下,我很好奇像“永久在线智能体”这类发布,是如何与这些重大研究进展相匹配的。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖