一个模型干两件事
Qwen-Image-2.1 是 Qwen 图像系列最新的开放权重版本。与常见的「生成一个模型、编辑另一个模型」不同,它用同一套权重同时承担文生图与指令式编辑:给提示词就生成,给指令加图就按指令改,工作流里不需要切换 checkpoint。ComfyUI 官方文档同时放出了文生图与指令编辑两个模板。
四个真正影响工作流的点
- 原生 2K:可以直接生成到 2048×2048,不需要先出小图再放大,减少了放大带来的细节漂移;
- 透明通道:VAE 带四个通道,透明背景可以生成与编辑,省掉事后抠图这一步;
- 多图参考:参考图按槽位顺序拼进文本编码器,节点提供 image_1 到 image_16,提示词用 <image1> 这样的索引引用,适合「把第二张图里的衣服穿到第一张图的人身上」这类需求;
- 局部编辑:只描述要改的对象或区域,其余画面保持不动。
模型文件与采样参数
两个模板加载同一批文件,扩散模型默认使用 int8 量化版以降低显存占用,需要更高精度时可换成 bf16 版。
ComfyUI/models/
text_encoders/ qwen3vl_8b_bf16.safetensors
diffusion_models/ qwen_image_2.1_int8_convrot.safetensors <- 模板默认
qwen_image_2.1_bf16.safetensors <- 全精度,更吃显存
vae/ qwen_image_2.1_vae_bf16.safetensors
采样参数:steps 25 / cfg 1 / euler / simple
文生图模板固定种子,图像编辑模板随机种子。许可这条线必须先看
模型卡上的许可字段是 Qwen Research,许可证正文写明只授予「非商业目的」的使用、复制、分发与修改权,并明确「未另行取得商业许可不得用于任何商业用途」。也就是说它适合研究、评估与内部试验,但产品化、收费服务都需要单独申请授权。对于把它当作原型工具使用的团队,这个限制不影响验证价值;对于准备上线的产品,这是第一条要过的关。