ChatGPT共创者给RLHF判死刑,推Jev成下一步
ChatGPT共创者,也是Jev的创始人 DiogoAlmeida 亲自给自己发明的RLHF判死刑:
“下一个时代不是Claude Code时代。Claude Code还在助手村——Jev才是下一步。
200倍快、400倍便宜、0幻觉。这才是RLHF之后该来的东西。”
17分钟里他把行业骂醒了:
模型被训练成超级讨好机器,连放屁都能被说成交响乐。
软件不需要陪聊,软件需要会做决定、还带置信度的脑子。
助手时代结束了,自动化才刚开始。
#Jev #TypeSafeAI #DiogoAlmeida #RLHF #ClaudeCode #SystemOne
Jev创始人、RLHF(人类反馈强化学习)的共同发明者表示:“像 Claude Code 这样的编程助手时代已经结束了!” 🚨💡⚡️
在一段时长17分钟的技术视频中,Diogo Almeida(前 OpenAI 研究员、RLHF 概念的发明者之一)详细解释了为什么目前所有可用的模型都存在一个根本性缺陷:训练目标是取悦人类,而非追求绝对精确!🔥
Jev模型和RLCD技术究竟创新了什么?
RLHF之后:从RLHF技术(它会让模型讨好用户)转向RLCD技术(强化学习实现极致精确的决策调整)。
速度提升200倍、成本降低400倍:结构化决策模型(System 1)运行速度极快,绝不会生成随机文本或幻觉!
零幻觉(0% Hallucination):因为模型专注于提供预先确定的概率和选项(选择与评分),而非生成自由文本。
从“辅助”转向“自主”:像 Claude Code 这样的工具仍然依赖直接辅助,而Jev专门用于构建自主决策智能体,面向复杂任务。
这个技术讲解价值超过数千美元,它讲解了从对话模型(Chat)到快速可靠决策模型(System 1)的即将到来的转变。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖