ChatGPT联合发明人憋两年做了个新AI模型Jev
有人刚刷完科技圈的热榜,发现讨论最多的不是新聊天机器人,而是一个叫Jev的模型。
它出自ChatGPT的联合发明人之手,发明人秘密研发了两年,这次刚对外公开。它用了一种叫RLCD(对比蒸馏强化学习)的新训练方法,不依赖人类反馈数据就能对齐模型,核心特点是专门针对决策任务优化。
和现在大家熟悉的大语言模型不一样,Jev不输出给人读的文本。常规大语言模型默认输出整段文字,Jev默认输出选择、分数、概率、置信度这些结果,更像可以直接被程序调用的判断函数。@CompleteSkeptic认为:这是基于AI的经济革命最短路径。
「@servasyy_ai 认为:Jev不是又一个新聊天模型,有意思的点是它把语言生成改成了决策原语。」
@harrisonitsme整理了核心差异:主流大语言模型生成文本,慢还贵;Jev只输出决策,不生产文本,用RLCD训练和并行推理替代原来的自回归,换来20-200倍的速度提升、40-400倍的成本优势,输出token还免费。名字来自杰文斯悖论——效率越高,用量反而越大。
测试里Jev可以每秒约10次模型调用运行《毁灭战士》,成本约为每小时7美元。放到日常场景里想,如果你需要AI帮你筛选简历、判断商品推荐是否合适、甚至帮游戏AI做动作决策,只需要得到一个判断结果,不需要AI给你写一段话解释。
这时候用Jev,不仅等待时间缩短,花费也能降几十倍。现在Jev还只是早期访问阶段,性能还没有第三方验证,不知道它能稳定处理多少种现实里的决策任务。
如果只做决策不输出文本就能满足大部分商业需求,以后我们还需要那么多能聊天的大模型吗?