通义千问模型自我迭代一个多月,完成33轮进化
兄弟们,今天我就在云栖大会现场。Qwen 这波东西放出来,这次不是单纯又发几个模型。模型已经开始自己下场,参与优化推理,甚至参与芯片设计了。
阿里这次重点讲了 RSI,Recursive Self-Improvement,递归自我进化。Qwen3.8-Max 已经在人类“零参与”的情况下,连续跑了一个多月,完成 33 轮有效迭代。🔥但我觉得真正狠的是后面两个。
第一个:自己优化推理。Qwen现在自适配和优化SGLang。单实例吞吐直接提升96%。
第���个更猛:开始参与芯片设计。给 Qwen3.8-Max 一份真实的总线模块 Spec,让它自己跑前端、验证、后端。连续干了 60 多小时,调用 EDA 工具超过 1 万次。
物理实现面积减少 42%。另外,下一代 Qwen4 已经投入训练,未来Qwen4.5、Qwen5等版本将扩展至5-10T参数,同时压低训练和推理成本。多模态也在继续补,像 Qwen3.8-Omni-Flash,已经把文本、图片、音频、视频放进统一理解框架。
我在现场最大的感受是: Qwen要把模型做强,也要把模型做便宜,甚至参与设计芯片。太刺激了。🚀