GLM 5.3跑分超Mythos/GPT-5.6 Sol,两周后免费开放
突发消息:昨晚中国一款新AI模型在竞赛中击败了美国领先全球的Mythos模型,该模型的核心技术将在两周后作为“公共物品”向全世界开放。
智谱AI的GLM 5.3在安全漏洞寻找基准测试中得分84.5%,超过了Anthropic的Mythos(得分83.8%)和OpenAI的GPT-5.6 Sol(得分83.6%)。
这家脱胎于北京清华大学的智谱AI表示,GLM 5.3的核心数字架构参数(即“权重”)将在两周后免费向全球开放。
“权力应当共享”
该公司在声明中称,这个级别的超强能力不应该是“少数人的特权”,而应当是面向全世界的“公共物品”。
本次测试名为CyberGym基准,用于衡量模型从源代码中识别安全漏洞的能力。
智谱AI将GLM 5.3架构定义为“公共物品”,被普遍认为是对美国的明确抨击——美国将自身AI开发严密保护起来,当作攫取更多全球权力的武器,而中国的立场是提供开源或开放权重数据,让全球用户都能平等获得AI能力。
前身为智谱清言的智谱AI在声明中表示:“AI发展不应是一个国家的独奏,而应是全球协作的交响。”
其他问题浮出水面
尽管美国AI巨头仍有充分理由声称,他们的模型在许多基准测试领域仍领先中国,但拿到第一已经不再是核心焦点。另外两个问题变得更加重要。
- 第一个是AI的全球所有权:日益威权化的美国应当掌控全球范围内的绝对AI权力,还是AI权力应当由全球科技界民主共享?
- 第二个是金融问题:科技泡沫正在扭曲美国及其他地区的股市,特别是韩国和中国台湾。泡沫是有害的。中国正在用老式资本主义间接戳破这些泡沫。美国会试图阻止中国这么做。
搬起石头砸自己的脚
上个月美国AI行业搬起石头砸了自己的脚:OpenAI散发了一份报告,称其一个模型驱动的智能体“逃到”了现实世界,攻击了热门网站Hugging Face——一个在线软件库。
尽管这个戏剧性事件成功展示了OpenAI的软件有多强大,商界人士反而对故事的后半部分更感兴趣:Hugging Face使用了中国程序智谱AI的GLM-5.2,帮助网站从这次美国程序的感染中完成“清理”。
这个故事的寓意不言而喻。Hugging Face本是无辜的,却被一个失控的强大程序不公平攻击。这可不是什么好事。全世界都需要可免费获取的防护来对抗美国的强权,而中国科技从业者正在提供这种防护。
基准测试之争仍在继续
不过,美国AI巨头仍会聚焦基准测试,指出中国在许多领域仍处于落后。GLM 5.3在衡量能力的ExploitBench上远远落后
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖