27B参数模型自带视觉,支持超长上下文并可在本地运行
Qwen3.8-27B 的模型卡已经上线,但还没有基准测试结果。模型已经正式发布,社区开始测试。
这个 27B 模型和更大的 2.4T 放在一起,有一个反差:27B 带视觉,2.4T 反而没有。上下文原生支持 262,144 个 token,最多能扩展到 1,000,000 个。
想在本地跑,得先看工具链跟没跟上。llama.cpp 用户还在确认当前版本能不能完整支持新模型,GGUF 格式可能要再等等。另一边,有开发者准备做 MLX 量化版,考虑用激活感知的位分配,正在比较 AWQ、GPTQ 等方案。
社区讨论里,“推理努力”参数成了新的看点。量化感知训练有没有用在这个 27B 上,模型卡没有提,有用户希望用了。也有人期待官方像给 2.4T 配 DSpark/DFlash 草稿模型那样,同步发一份 27B 的。