参与训练GPT-6的研究员本人被GPT-6的能力震惊了
连训模型的人,都快被模型创飞了。
刚看朋友分享了一个大佬的朋友圈,挺震撼的。
他让 GPT-6 去复现自己大一时候做的一篇电路布线论文。 这不是随便一个课设。当年这东西发了 CCF A 类期刊,他还申请过专利。 结果 GPT-6 一分钟就复现完了。 然后他又临时想了一个改进方向,让模型继续往下做,不到半天,新的方案也弄出来了。
这件事最冲击我的其实不是一分钟浮现论文本身。 而是发这条朋友圈的人,本身就是参与训练 GPT-6 的人。 也就是说,连最接近模型、最清楚它能力边界、甚至亲手参与把它训练出来的人,真正开始拿它做自己的研究时,还是会被它吓到。
他后面有句话我特别有感触。 以前做 research,很像一次特别长的 RL rollout。一个方向可能要做几个月甚至几年,最后才知道对不对。 但现在,一个想法上午提出来,下午可能就已经验证完了。
所以他说,以前人总幻想“朝闻道,夕死可矣”。 但如果以后真的可以天天朝闻道,每天都有新的答案、新的方法摆在你面前,那种感觉其实很难形容。
可能很多人现在还觉得,GPT-6 不就是又一个更强的模型。 但我这两天越来越明显地感觉到,真正做 AI、做研究、做工程的人,对GPT-6反应其实都差不多。 大家不是没想过这一天会来。 只是没想到真来的时候,还是会这么震撼。 更没想到,会这么快。
PS:这个佬挺活跃的,大部分人都知道吧?