OpenAI用AI搞定了一堆难倒人类的数学题
有人刚写完一篇数学小论文,花了大半年时间改完证明,正准备投稿。
打开GitHub一看,OpenAI已经把数百篇AI生成的数学论文公开了,里面还有几个悬了几十年的公开问题的解法。
这次OpenAI发布的成果,来自内部前沿模型GPT-6 Astra,一共公开了722篇AI生成的数学论文,归为372组结果,全部放在GitHub的openai/math仓库,所有人都可以免费查看。这个模型就是之前宣称解决了纳维-斯托克斯方程问题(千禧年七大数学难题之一)的同一个模型,从今年8月28日开始训练,能力比OpenAI已经发布的GPT-6 Astra更强。
在此之前,GPT-6 Astra已经在FrontierMath测试中取得了98%的得分,独立评估显示它能在短时间内解决人类专家需要约半小时才能解决的数学问题,性能超出上一代模型GPT-5.6 Sol一个数量级。这次发布过程,OpenAI也参考了美国高等研究院独立数学与人工智能咨询小组的建议。
「@burny_tech 认为:这些结果已经非常惊艳,接下来就看AI什么时候能发明出像代数几何这样级别的全新数学结构、概念和理论了。」
「@fiapp_pro 认为:喜欢应试教育吗,洋人来给你治治,寒窗苦读二十年,到头来智商、能力不如200块的GPT大会员高。」
这件事不是只跟数学界有关。已经有研究指出,这次成果发布后,我们需要重新思考数学教育,尤其是针对数学专业者的教育方向,同时也要关注就业市场和数学工作性质的变化。
简单来说,以前需要几个博士生花两三年整理的证明推导,现在AI几天就能出结果,普通研究者只需要判断方向对不对就行。
很多人在说AI会替代人类工作,这次AI直接闯进了最依赖人类智力的数学领域。以后数学研究的分工,会不会变成人类提问题,AI来解决?