AI Pulse
🔥 热点深度解读

国产AI芯片跑通的顶级开源大模型正式发布了

有人此前在开源社区玩到匿名模型Ox Alpha,惊叹它的性能超出预期。

2026年8月14日,Z.ai正式官宣:这个爆火的匿名模型,就是全新发布的GLM-5.3-Flash。

这是GLM-5系列首个原生支持同时处理文字、图片的多模态(理解多种类型信息)大模型,拥有100万token(约75万字,相当于一本厚书)的上下文窗口,可以一次性处理完整的长文档。

它采用混合专家架构,总共有320亿总参数,每次只激活18亿参数,体积不到前代GLM-5.2的一半,却在所有测试中都打败了GLM-5.2。在Terminal-Bench 3.0测试中,得分从GLM-5.2的4.6提升到28.3,CyberGym网络安全测试中拿到84.5%的成绩,这个分数在所有开放权重模型中处于领先位置,甚至有开发者认为它的能力已经接近Opus-4.8。

更特别的是,整个模型可以完全运行在中国国产AI芯片上。通过软件和芯片协同优化,智谱实现了比NVIDIA芯片高3倍的端到端推理性能。模型以完全开放的MIT许可证发布,任何人都可以免费下载权重、修改、商用,部署门槛也不算高:有评测指出,只要8张3090显卡,或是256G内存的Mac M5 Ultra,就能运行这个前沿级别的模型,整体硬件成本大约1万美元。

@Yuchenj_UW 认为:GLM-5.3-Flash是一件非常重要的事,Zai_org一直在用越来越高的效率推动前沿AI发展。

@bookwormengr 认为:这是中国实验室用低成本做出优秀成果的绝佳例子,团队吸收同行创新的速度非常快。

对想要自己部署AI、或是做二次开发的开发者来说,现在不用再依赖闭源的商业模型,就能拿到性能接近顶级闭源模型的开源产品,而且完全运行在国产芯片上,成本和数据安全的门槛都降了一大截。

目前它在代码开发榜已经排到全球第五,开源模型里第二。

接下来,它会不会把顶级大模型的部署门槛,拉到普通小团队也能摸得到的位置?

📎 参考来源

查看原始推文

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新