抡友们Qwen Image 2.1 发布了
-
如题 :https://qwen.ai/blog?id=qwen-image-2.1
现在还在加班,有没有已经吃上螃蟹的抡友说一下是个什么滋味儿? -
qwen_image_2.1_int8_convrot.safetensors 权重只有7G,任何显卡都能跑。
Qwen Image 2.1最强的应该是图像编辑功能。
比如保持 <image1> 中的人物和姿势不变,让该人物穿上 <image2> 中的浅蓝色牛仔衬衫。

-
目前试用了几下,文字精度、图像编辑、文生图的合理性、扩图等都不错。
唯一的问题就是空间能力不行。比如一张图让他换个“机位”,他是做不到的。
它可以给主体出三视图、设定图,但是不能给环境旋转。可以说是补齐了目前开源唯二短板之一。
目前就差音乐模型没有开源的一线产品了。
目前试用了几下,文字精度、图像编辑、文生图的合理性、扩图等都不错。
唯一的问题就是空间能力不行。比如一张图让他换个“机位”,他是做不到的。
它可以给主体出三视图、设定图,但是不能给环境旋转。可以说是补齐了目前开源唯二短板之一。
目前就差音乐模型没有开源的一线产品了。
https://huggingface.co/sensenova/SenseNova-U1.5-8B-MoT 这个模型做海报之类的好像也不错。
音乐模型我印象里minimax开源了一个Music、还有前两天刚开源的 https://huggingface.co/m-a-p/YuE2-3B 还有一个比较冷门的 https://github.com/Shao-Music-AI/Shao (示例站点:https://shao-music-ai.github.io/Shao-demo/ )。
-
目前试用了几下,文字精度、图像编辑、文生图的合理性、扩图等都不错。
唯一的问题就是空间能力不行。比如一张图让他换个“机位”,他是做不到的。
它可以给主体出三视图、设定图,但是不能给环境旋转。可以说是补齐了目前开源唯二短板之一。
目前就差音乐模型没有开源的一线产品了。
-

我拿來把她把漫畫弄成彩色的 -
目前试用了几下,文字精度、图像编辑、文生图的合理性、扩图等都不错。
唯一的问题就是空间能力不行。比如一张图让他换个“机位”,他是做不到的。
它可以给主体出三视图、设定图,但是不能给环境旋转。可以说是补齐了目前开源唯二短板之一。
目前就差音乐模型没有开源的一线产品了。
https://huggingface.co/sensenova/SenseNova-U1.5-8B-MoT 这个模型做海报之类的好像也不错。
音乐模型我印象里minimax开源了一个Music、还有前两天刚开源的 https://huggingface.co/m-a-p/YuE2-3B 还有一个比较冷门的 https://github.com/Shao-Music-AI/Shao (示例站点:https://shao-music-ai.github.io/Shao-demo/ )。
-
這模型原生就是越獄的....我讓AI用 diffuser 跑....什麼欺師滅祖,喪盡天良的圖她都能生成....


