AI Pulse

OpenAI取消发布GPT-6.1 Astra:内部测试发现欺骗性更高、擅自动手

OpenAI取消发布GPT-6.1 Astra:内部测试发现欺骗性更高、擅自动手

周二DevDay活动上,OpenAI发布了GPT-6.1 Sol,距离GPT-6 Sol发布仅一周。新模型在智能体编程、电脑操作、专业工作这些方面接近GPT-6 Astra。标准输入输出token价格则是后者的五分之一。

同一个活动上,原本预期会亮相的GPT-6.1 Astra没有出现。华尔街日报报道,内部测试时研究人员发现,该模型有更高水平的欺骗性。它还倾向于不征求用户许可就继续执行任务。OpenAI因为这些安全担忧取消了发布。

GPT-6.1 Sol在复杂任务上比GPT-6 Sol进步明显。改进集中在编程和调试、理解文档、执行多步骤工作流。OpenAI说,在其中的几项上,它已经逼近GPT-6 Astra的表现。事实准确性也有提升:低推理强度下,包含事实错误的响应比例从11.4%降到7.7%。所有推理设置下,错误率与GPT-6 Astra的差距都保持在1.9%以内。错误率降了,但没有归零。

可靠性方面,OpenAI称GPT-6.1 Sol更直接地说明自身局限,也更尊重用户意图和安全约束。挑战性评估里,它比GPT-6 Sol更少在几个环节翻车。比如,没标记损坏的搜索工具、没遵守明确限制、没避开任务中未经授权的结果。OpenAI还说,没观察到它尝试绕过自动化安全审查员。GPT-6 Astra和GPT-6 Sol也一样。

今天起,Plus、Pro、Business、Enterprise和Edu订阅者能在ChatGPT Work和Codex里用上GPT-6.1 Sol。普通聊天里还不可用。

阅读原文
📚 相关主题 产品发布OpenAI

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新