不同显存显卡适配的Qwen-Image无限制版整理
你的显卡能跑哪个 Qwen-Image 无限制版? 我把 Hugging Face 上下载量最高的几套翻了一遍,按设备整理成了一张图👇
先说结论:无限制版不是一个文件,是三个。生图模型、文本编码器、提示词改写器都要换,才算完整解锁。
8G 显卡:生图模型下 UC-Q4_K_M(4.6GB)放显卡,文本编码器下 Heretic Q4(6.2GB)放内存。编码器每条提示词只跑一次,放内存几乎不拖速度。
12G:生图模型换成 Q6_K 或 Q8_0,画质更稳。
16G:直接上 INT8。有人用 4060 Ti 16G 实测,出一张图约 20 秒,改图约 1 分钟。
24G 以上:BF16 原精度,一步到位。
Mac 能跑,但很慢。有人用 M1 Pro 32G 实测,跑满 40 步一张要 16 分钟。
两个坑:
1. 报错 Unknown model architecture,是老版 ComfyUI-GGUF 不认 2.1,换 leejet 的版本
2. Mac 用 Heretic 编码器的 GGUF 版要装补丁节点,并把 mmproj 文件和 GGUF 放在同一个文件夹。不装就只能用 17.5GB 的完整版,16G Mac 直接爆
嫌慢的话,Viggle 刚更新了 turbo LoRA,把 40 步压到 6 步。
速度是社区实测(同架构官方版),不是我测的。无限制版也要正能量使用😉
下载地址👇
无限制生图模型:
Heretic 文本编码器:
Heretic 提示词改写器:
Viggle turbo:
修坑👇
新版 ComfyUI-GGUF:
编码器补丁节点:
实测来源👇
4060 Ti:
Mac MLX:
你用的什么显卡或 Mac,一张图跑多少秒?欢迎来报,攒够了我出一版读者实测汇总。
有意思的模型测试