Echo's blog
Echo's blog
· 1 min read · 人工智能

Qwen-Image-2.1开放权重并支持ComfyUI,商家做营销图先看授权

Qwen-Image-2.1开放权重并获ComfyUI支持,可生成透明素材、参考多图和局部编辑。商家制作营销图前,需确认商用许可、运行门槛和商品还原质量。

商品抠图、换背景,可以放进同一个模型#

做一张促销图,常常要先把商品从照片里抠出来,再换背景、调位置、改文字。9 月 20 日发布的 Qwen-Image-2.1,把按文字生成图片与修改现有图片放进了同一个模型,并开放权重;当晚,官方又确认它已获得 ComfyUI 支持。对商家而言,可关注的是素材重复利用,但这次开放采用研究许可证,商业使用需要另行获得许可。

这款模型新增的实用变化是原生透明图像。普通图片把主体和背景一起保存;带透明通道的图片可以只留下商品或装饰元素,放到其他版面上继续用。模型能根据文字要求生成普通图或透明图,也能直接修改透明图层,或者从已有照片中提取主体,输出带透明通道的 RGBA 图像。

透明图像能力并非首次出现在千问系列中。2025 年 12 月发布的 Qwen-Image-Layered 已专门处理这类任务;此次更新把它纳入统一的生成与编辑模型。官方展示了单个透明素材、多元素组合,以及保留透明背景改变表情的例子,还演示了替换透明图层里的文字。生成、抠出主体和继续修改,现在可以围绕同一个模型展开。

模型还支持一次输入最多 10 张参考图片。官方示例包括把六张单人人像合成一张合影,将模特、服装、鞋、包和帽子五张图组合成一套穿搭,以及用十张家具图布置房间。这里的“10 张”说的是一次编辑可参考的输入上限,不能理解为十件商品都能毫无偏差地还原。

局部修改也有几种做法:在原图上画圈、涂抹标记,或者另给一张蒙版。蒙版可以理解为标出允许修改范围的图。官方示例在同一张图中圈出手表、头发和衣服,分别提出移除或更换要求。画圈和涂抹会遮住原画面的一部分,因此模型也接受原图与独立蒙版两个输入,让原图信息保留下来。

这些能力可以连续使用,逐次改动场景局部;公告还展示了将连续编辑结果组成简单动画的例子。它并不等同于已经交付一套自动制作广告视频的服务。多图合成、透明素材和局部修改的效果,目前这里引用的都是官方展示,本文没有做独立实测。

商家将商品透明图层放进不同海报背景的手绘示意 透明主体便于在不同版面继续排版,图为 AI 生成示意,非模型实测结果。

ComfyUI 提供工作流入口,运行和许可仍有门槛#

Qwen-Image-2.1 的视觉生成部分有 70 亿参数、32 层单流 DiT 结构。参数可以粗略理解为模型内部学习到的数值,70 亿描述的是视觉生成组件,不能据此推算整套软件需要多少显存。官方强调轻量设计,希望兼顾画面质量和计算成本,并展示了自有评测 Qwen-Image-Bench 与其他模型的对比;这不直接证明每家商店都能低成本运行。

效率改进来自对文字和图像采用不同处理粒度:文字按更细的小单元处理,图像按块处理。它还会把输入图片和编辑指令中不变的信息先算好、缓存起来,在后续生成步骤重复使用。这种叫作 KV 缓存复用的办法,主要为了减少重复计算,尤其面向多张参考图的编辑。公告称可提升推理效率、降低内存使用,但没有给出适用于普通商家电脑的统一耗时或费用承诺。

画面质量方面,官方强调人物身份与商品一致性:编辑人像时尽量保留面部特征,修改商品图时尽量保留文字、纹理和形状。文字生成还涉及字形风格、排版及其与整体画面的关系;人像则改进了光照与细节。这些是开发方描述的改进方向,不能替代对商品标签、颜色和外形的逐项核对。

公告列出的任务还包括全景图、信息图和分镜:从自拍扩展全景,再用可视化工具查看不同方向;把人物照片扩展为信息丰富的画面;根据角色三视图生成故事分镜。模型卡同时提供 2048×2048 生成示例和横竖多种画幅,展示了通常所说的 2K 级输出。画幅能力与广告平台最终要求的尺寸仍需分别确认。

9 月 20 日 21 时 52 分的官方消息确认了 ComfyUI 支持。ComfyUI 是把模型、输入图片和处理步骤连接成工作流的工具,有支持入口不代表普通用户打开网页就能免安装使用。模型卡的快速开始仍涉及安装软件组件、加载权重和使用 GPU,并列出把部分模型计算转移到电脑内存的优化办法;也给出了演示链接,但本文未验证演示的排队、收费或可用地区。

尤其需要分清开放下载和商用授权。模型卡指向 Qwen Research License Agreement,许可证日期为 9 月 20 日,明确限定非商业研究或评估,商业使用须另行申请许可。官方公告使用“开源”表述,商家实际决策应以具体许可条款为准。目前核验材料没有列出商业授权报价,也没有给出面向小商家的免部署套餐。

设计师与店主整理商品参考素材的手绘示意 ComfyUI 工作流仍需要运行环境和配置,图为 AI 生成示意,非产品界面。

商家先确认授权,再判断能省下哪一步#

对普通店主,这条新闻最容易对应到反复做促销素材的麻烦。以下是应用建议,尚未验证实际效果:如果一家茶叶店经常把同一罐茶放进节日海报,可以请设计师评估透明主体能否重复使用、换背景后罐体是否保持原样。服装店则可关注多张单品参考图的组合。不过,上线店铺图片和付费广告属于商业场景,开始商用前应先确认自己或服务商取得了相应许可,不能仅凭“权重免费下载”就投入经营。

把目标缩小到一个步骤,比较容易判断值不值得。例如先观察商品边缘是否干净、透明部分是否残留背景,再看更换场景后包装文字有没有变。如果字体、规格或颜色被改错,返修时间可能抵消省下的时间。官方说改进了保真度,也仍要拿生成图对照实物照片;直接用于售卖时,商品的实际外观比画面好看更重要。

没有技术人员的商家,不必为了赶热点自己搭 ComfyUI。先询问已有设计供应商能否提供合规的试样,或等待条款清楚的现成服务,更容易控制投入。已经使用 ComfyUI 的设计团队,可以在获准的使用范围内评估工作流兼容性。硬件、安装维护和反复调图都要花时间;本文没有价格依据,不能给出“每张只花几分钱”之类结论。

一次需要很多参考图时,也要想清楚哪些图确实必要。把模特、衣服和配饰交给模型之前,应确认图片版权和肖像授权;使用第三方在线工具,还应查清图片会被上传到哪里。未公开的新品和客户照片,不宜随手传到不了解的服务中。模型许可、素材权利与服务平台条款是不同问题,某一项允许使用不代表其余问题自动解决。

比较合适的起点,是拿一项重复出现的素材任务评估,记录合格图和返修所需时间。对偶尔做一张通知海报的小店,现有模板加人工排版可能已经够用;对长期批量做商品场景图的团队,透明素材与多图编辑更值得持续关注。是否采用,应等授权、运行条件和自己的样图质量都有答案后再定。活动日期、价格、折扣和商品承诺仍由店主逐字确认,别把文字渲染的进步当成校对已经完成。

店主与设计师核对商品和营销草图的手绘示意 商品图用于经营前,应先确认授权并对照实物复核,图为 AI 生成示意。

消息参考来源

Comments

Copied
Copied to clipboard