抡友们Qwen Image 2.1 发布了
-
@Bunsei 正在玩, 0.41.0.dev0 才能跑起来, main分支里面还没更新呢
看着效果馋死了。好像赶紧回家试试看。
-
「文件多大就要多大显存」是常见误解。ComfyUI / 扩散流水线是分阶段加载的,32G 是磁盘上几个模块加起来的体积,不等于显存峰值:
- 文本编码器(约 15G)、DiT 主模型(johnnybegood 实测 17G)、VAE(约 1.2G)通常不会同时驻留:编码 prompt 用 text encoder,出图换 DiT,VAE 只在最后解码。ComfyUI 会顺序 load/unload,峰值主要看「同时驻留的最大模块 + 分辨率/批大小的激活 + attention 实现」。
- 所以 24G 的 3090 能跑不奇怪(实测 17G 占用),48G 的 4090/W7900 只是余量更大:能上更高分辨率、更大 batch、更少 offload,不是门槛。Geekyang 说的 32G 更接近「安装包总量」,不是「显存需求」。
- 2752×1536、40 步、6.9 s/step 偏慢,先分清是算力还是换页:nvidia-smi dmon 看显存占用和 SM 利用率——显存贴着 24G 且利用率低 → 在 offload/换页;利用率高 → 就是分辨率²×步数本身。可优化项:text encoder 换 fp8/GGUF 并放 CPU/offload、DiT 用 fp8/GGUF、开 flash/sage attention(SDPA/xformers)、VAE tiling、降分辨率或上 Lightning/LoRA 少步。
- 另外确认你下的是哪一版权重(原生 / GGUF / fp8),格式直接决定显存占用和能不能在 24G 上舒服跑。
-
如题 :https://qwen.ai/blog?id=qwen-image-2.1
现在还在加班,有没有已经吃上螃蟹的抡友说一下是个什么滋味儿? -
qwen_image_2.1_int8_convrot.safetensors 权重只有7G,任何显卡都能跑。
Qwen Image 2.1最强的应该是图像编辑功能。
比如保持 <image1> 中的人物和姿势不变,让该人物穿上 <image2> 中的浅蓝色牛仔衬衫。

-
目前试用了几下,文字精度、图像编辑、文生图的合理性、扩图等都不错。
唯一的问题就是空间能力不行。比如一张图让他换个“机位”,他是做不到的。
它可以给主体出三视图、设定图,但是不能给环境旋转。可以说是补齐了目前开源唯二短板之一。
目前就差音乐模型没有开源的一线产品了。
目前试用了几下,文字精度、图像编辑、文生图的合理性、扩图等都不错。
唯一的问题就是空间能力不行。比如一张图让他换个“机位”,他是做不到的。
它可以给主体出三视图、设定图,但是不能给环境旋转。可以说是补齐了目前开源唯二短板之一。
目前就差音乐模型没有开源的一线产品了。
https://huggingface.co/sensenova/SenseNova-U1.5-8B-MoT 这个模型做海报之类的好像也不错。
音乐模型我印象里minimax开源了一个Music、还有前两天刚开源的 https://huggingface.co/m-a-p/YuE2-3B 还有一个比较冷门的 https://github.com/Shao-Music-AI/Shao (示例站点:https://shao-music-ai.github.io/Shao-demo/ )。
-
目前试用了几下,文字精度、图像编辑、文生图的合理性、扩图等都不错。
唯一的问题就是空间能力不行。比如一张图让他换个“机位”,他是做不到的。
它可以给主体出三视图、设定图,但是不能给环境旋转。可以说是补齐了目前开源唯二短板之一。
目前就差音乐模型没有开源的一线产品了。
-

我拿來把她把漫畫弄成彩色的 -
目前试用了几下,文字精度、图像编辑、文生图的合理性、扩图等都不错。
唯一的问题就是空间能力不行。比如一张图让他换个“机位”,他是做不到的。
它可以给主体出三视图、设定图,但是不能给环境旋转。可以说是补齐了目前开源唯二短板之一。
目前就差音乐模型没有开源的一线产品了。
https://huggingface.co/sensenova/SenseNova-U1.5-8B-MoT 这个模型做海报之类的好像也不错。
音乐模型我印象里minimax开源了一个Music、还有前两天刚开源的 https://huggingface.co/m-a-p/YuE2-3B 还有一个比较冷门的 https://github.com/Shao-Music-AI/Shao (示例站点:https://shao-music-ai.github.io/Shao-demo/ )。
-
這模型原生就是越獄的....我讓AI用 diffuser 跑....什麼欺師滅祖,喪盡天良的圖她都能生成....



