Qwen 新模型 8 步出图,参数不调对反而更慢
Qwen 在 Hugging Face 上架了 Qwen-Image-2.1-Turbo,目标是用更少的生成步骤在本地出图。已经有人放出了一个 Mac 上的运行仓库链接,想绕开复杂配置的人至少有了一个入口。但本地运行仍然要配置。
这个 Turbo 变体与 2.1 标准版的具体区别,目前没有公开说明。核心变化是 8 步生成:采样被压缩到 8 步,等待时间理论上会短不少。想真正吃到这个好处,得把 true_cfg_scale 调到 1.0。true_cfg_scale 就是常说的 guidance scale,控制模型对提示词有多听话。原因是模型属于蒸馏检查点,引导已经内嵌在训练里。cfg 还留在 4 的话,每一步会跑两次前向传播。总调用次数回到约 16 次,对比度还会发灰。参数不调对,速度优势丢掉,画面也容易变淡。
另一个坑是 LoRA。针对基础 2.1 训练的 LoRA,在 8 步模式下容易过度处理,有人的做法是把权重降到 0.6 左右。低 cfg 对 Turbo 更友好,但也牺牲指令遵循。有人反馈,Qwen 2.1 Image 在 cfg 为 1 时不怎么听话,只好回到 cfg 6。速度和控制之间,现在没有通用解。
有人在催 FP8 和 abliterated。FP8 是低精度格式,用来减少显存占用;abliterated 是去掉内容安全限制的修改版。官方会不会出 FP8 或 abliterated、Mac 上的第三方封装稳不稳定,现在都没有定论。低 cfg 下指令遵循差的问题有没有修复,也还悬着。还有人提到发布时点在一个长周末之前。最近 turbo 图像模型一个接一个,选择变多,挑起来也更费劲。
眼下,Qwen-Image-2.1-Turbo 确实给了本地快速出图的可能性,但要把它用好,得自己调 cfg、调 LoRA 权重,在速度和控制之间取舍。在官方给出更细的参数说明之前,这些设置就是每个想本地跑的人绕不开的前提。