GLM-5.3 开放可商用,普通人也能本地部署
GLM 5.3 现已在 Perplexity Computer 可用。它为长上下文多模态智能体工作负载打造,在 WANDR(我们用于大规模、有证据支撑研究的基准测试)上性能超过了 GLM 5.2。
十天前:DFlash 2。今天:GLM 5.3——推理草稿模型训练完成,NVFP4 检查点已放出,GB300 上的端点已上线。DFlash 2 只是第一部分。这次是完整全栈!
来自 @Zai_org 的 GLM-5.3 现已开放权重,并在 OpenRouter 上线。它为复杂软件工程、长周期智能体和网络安全打造,拥有 1M 上下文,可配置推理工作量。
GLM-5.3 已正式在 Hugging Face 上线。本地运行它的配置要求:
- FP8:10–12 块 H100 或 8 块 H200
- 4-bit/NVFP4,约 390–430GB 显存:一台 512GB Mac Studio 或 4 台 DGX Spark
- 激进压缩 2-bit,约 230–250GB 显存:一台 256GB Mac Studio 或 2 台 DGX Spark,会牺牲质量和上下文容量
首批 GGUF 和 NVFP4 量化版本已经出现。快来体验最先进的本地 AI 吧。
GLM-5.3 现在可供下载、本地部署、微调,并可在 GLM-5.3 许可下用于商业用途。考虑到该模型拥有先进的网络安全能力,我们在发布权重前额外开展了两周的全面安全评估。
根据当前许可,只有年营收超过 100 亿美元的机构将 GLM-5.3 作为外部模型服务提供时,才需要进行安全审查。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖