AI Pulse

七小时后,大模型就能跑进你家电脑

Qwen 3.8(通义千问)系列七小时后发布,首发是一个 2.4T 参数模型。27B 有单独页面,倒计时比 2.4T 晚两天。系列里其他型号会陆续放出,可能在不同的页面。

社区最期待的是 122B。它能在低显存环境下跑,这让本地部署变得现实。8B、9B、35B 这些更小的规格也有人点名,有人在等 8B 和 9B 落地。

关于开放程度,多数人预期系列会开源。有人纠正:更准确的说法是开放权重,除非通义把足以复现模型的技术栈也放出来。权重开放后,社区能做微调和本地部署;能复现到什么程度,要看后续给了多少。

发布到好用还有时间差。有人预计,要等几周才会有合适的量化版本,MTP(多令牌预测)支持可能也要等。量化版能把硬件要求再压低,但要等社区把活干完。

社区情绪不低。有人评价:历史性事件,我们准备好了,Google Translate 显然还没准备好。有人说,五年前还不知道“模型”是什么,现在会为本地跑 27B 兴奋。还有人觉得难以置信:上一代 27B 仍是同类顶尖,通义又出了新款 27B。

其余参数规模怎么放、开放权重附带多少可复现用的技术栈,这些要等发布后才清楚。

阅读原文
📚 相关主题 大语言模型开源

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新