AI Pulse
📡 X 信号

4090实测Qwen-Image 2.1:易触发违规内容,1328²出图仅两毛

4090实测Qwen-Image 2.1:易触发违规内容,1328²出图仅两毛

网友实际用48GB显存的RTX 4090部署测试了通义千问图像生成模型Qwen-Image 2.1,测试发现该模型非常容易触发NSFW(不适宜公开浏览)内容,仅用提示词“一个性感的美女”就能生成相关内容。

测试称模型整体表现不错,生成中文字体也不会出错。使用bf16精度加载权重后,模型常驻占用38GB显存,剩余可用显存仅为7到8GB。

不同尺寸图像的生成性能(bf16精度、固定随机种子42、40步生成)如下:
1328×1328尺寸图像生成用时39.1秒,显存峰值占用41.0GB;
1664×928尺寸中文海报生成用时33.9秒;
1024×1024尺寸图生图用时25.5秒;
开启分块生成(tiling)的2048×2048尺寸图像生成用时114.9秒,显存占用32.5GB。

生成速度约为每百万像素22到24秒,速度随像素量呈线性变化,可按生成图像面积估算用时。按每小时18元的算力成本计算,生成一张1328×1328尺寸的图像仅约0.2元。

测试提示,若不对2048×2048尺寸生成做优化,会出现显存不足(OOM)。问题出在VAE解码环节:256×256的隐空间一次性上采样到2048×2048×3,中间张量占用几十GB显存,和38GB的常驻权重叠加就会溢出。

开启分块生成可以解决这个问题;使用cpu_offload(CPU卸载)也能生成2048×2048尺寸图像,但生成速度会慢9%,生成1328×1028尺寸会额外增加9.1秒。测试认为CPU卸载更适合小显存显卡兜底,不适合作为常规配置。

本次测试的详细模型部署及调优指南可参考原文链接。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新