关于GLM-5.3-Flash免费的说法,知识库里能查到不止一个来源,而且"免费"其实分几种不同性质:有的是模型本体开源免费,有的是第三方平台限时免费用,还有的是官方开放免费使用档位,各自的条件也不一样。

最早的风声出现在2026年8月15日,当时的说法是这个模型跑分超过Mythos和GPT-5.6 Sol,并预告两周后免费开放,理由是如果权重真的免费开放,全球普通人都能用上顶尖能力 [11]。随后8月19日,ZenMuxAI上线GLM-5.3限时免费开放,主打编码性能比前代提升50%,并新增代码审计和漏洞发现能力,面向需要编码和网络安全工具的用户 [6]

到8月26日至27日前后,免费的说法开始集中出现。8月26日有消息称此前匿名流传的Ox Alpha就是这款模型,总参数320B、每次只激活18B,测试得分超过Claude Opus 4.8,并且已经开源 [5]。8月27日的报道进一步说明它是纯国产AI芯片打造,0成本就能调用,在编程和智能体场景性能接近Claude Opus 4.8,可直接免费体验 [2]。到了8月29日,又有报道称国产GLM-5.3 AI模型如约免费开放,高性能模型可对标顶级竞品,普通用户也能免费使用 [3]

开源和免费使用之间还有一层区别值得注意。根据发布信息,GLM-5.3-Flash采用MIT许可,允许自由使用、修改、商用,没有附加条款限制,企业可以把它集成进自己的产品包括商业用途 [18][14]。这属于权重开源层面的免费,与某个平台提供免费额度是两回事。发布渠道上,API服务已在Z.ai API平台开放,模型ID是zai-org/GLM-5.3-Flash,本地部署可选SGLang、vLLM、TokenSpeed、KTransformers四个推理框架 [18]

具体到"怎么免费用",不同渠道给的条件并不相同。8月28日的消息称,这个匿名登顶OpenRouter排行榜一周的模型已经开放免费使用档位,所有人都能直接体验 [1]。9月3日Together Chat开放GLM 5.3免费测试,不用到处找入口、不用配置API,直接选模型就能开始体验 [9]。而9月5日的消息则给了更细的限制条件:针对编码开发者调整了使用限制,工作日早八点到晚六点可以无限制使用,满足大部分日常编码需求 [4]。也就是说,这一档的免费是分时段的。

所以严格讲,"谁说免费了"的答案是一串来源:ZenMuxAI、Zai_org方向的全量免费开放报道、Together Chat,以及OpenRouter上的免费档位,各自对应不同的时间和使用条件 [6][2][9][1]。另外还有一条属于本地部署路线的参考:有人自建八千美元硬件就能跑,速度还比API服务快 [19]。需要提醒的是,这些免费描述来自知识库中的报道,具体的开放时间、时段限制和是否限速,仍要以各平台当时的实际条款为准。