Qwen-Image-2.1
阿里巴巴通义千问(Qwen)团队推出的开源图像生成模型,模型权重在Hugging Face平台开放下载,支持本地部署、微调和二次开发
核心事实
时间轴 (近 90 天)
Qwen-Image-2.1可在4060Ti 16G显存上本地运行,ComfyUI在Day 0完成节点集成
Comfy Org的Qwen-Image-2.1整合版发布三天拿下567万下载,Vigo的Turbo加速版24万下载,社区GGUF量化版137万下载
图像模型在卸载时可保持 INT8 或 FP8 精度,Z-Image 生成耗时在 10 GiB 显存上限的 B200 上从 38.4 秒降至 2.3 秒
阿里通义千问开源发布Qwen-Image-2.1,在Arena图像编辑和文生图两项榜单中均位列开源模型第一,图像编辑项目进入总榜第16位
Qwen-Image-2.1 的视觉生成部分仅有 7B 参数
Qwen-Image-2.1 权重开源后出现了移除拒绝层的越狱版
对于显存在8GB左右的消费级显卡,Q4或Q5通常是流畅运行Qwen-Image-2.1的实用起点
越狱版通过对原始权重二次微调或修改输出层偏置移除了模型的拒绝层,使内容过滤机制失效
Qwen-Image-2.1 已原生支持在 ComfyUI 中运行,可在消费级显卡上使用
统一 checkpoint 能否在两类任务上同时达到专用模型的水准,是评估此类架构最核心的问题
还有 40 条时间轴事件
全部知识事实 (20)
Qwen-Image-Edit是阿里巴巴通义千问团队推出的图像编辑模型,具备图像生成和局部编辑能力
90%已验证Qwen Image是阿里推出的文生图模型
90%已验证Qwen的图像生成能力基于扩散模型(Diffusion Model)技术
80%已验证测试者提到 Qwen Image 2.1 的图像编辑和参考图能力看起来不错
70%已验证Qwen-Image-2.1 支持最多 10 张参考图像并提供精确的局部控制
65%已验证Qwen-Image-2.1 可通过 GitHub、ModelScope 和 Hugging Face 多个渠道获取
65%已验证Qwen-Image-2.1 原生支持 RGBA 图层的生成与编辑,可直接输出带透明通道的图像
65%已验证阿里的Qwen-Image-2.1开放权重,采用7B架构,生成与编辑集成在同一个模型中,并原生支持透明图层
65%部分验证借助 Qwen Image 2.1 的图像编辑工作流,换脸过程可以简化到两张图加一段提示词,无需任何遮罩操作
80%待验证图像模型在卸载时可保持 INT8 或 FP8 精度,Z-Image 生成耗时在 10 GiB 显存上限的 B200 上从 38.4 秒降至 2.3 秒
70%待验证已安装 ComfyUI 的用户通常只需更新到支持该模型的版本并下载对应模型权重文件即可通过节点加载使用 Qwen-Image-2.1
60%待验证Qwen-Image-2.1 采用单一开源权重同时支持图像生成与编辑(One open-weight checkpoint for both generation and editing)的设计
60%待验证Qwen-Image-2.1 采用仅 7B 参数的轻量架构
60%待验证官方列举 Qwen-Image-2.1 支持全景图、信息图和虚拟试穿等应用场景
60%待验证Comfy Org的Qwen-Image-2.1整合版发布三天拿下567万下载,Vigo的Turbo加速版24万下载,社区GGUF量化版137万下载
50%待验证Qwen-Image-2.1可在4060Ti 16G显存上本地运行,ComfyUI在Day 0完成节点集成
50%待验证阿里通义千问开源发布Qwen-Image-2.1,在Arena图像编辑和文生图两项榜单中均位列开源模型第一,图像编辑项目进入总榜第16位
50%待验证越狱版通过对原始权重二次微调或修改输出层偏置移除了模型的拒绝层,使内容过滤机制失效
50%待验证Qwen-Image-2.1 已原生支持在 ComfyUI 中运行,可在消费级显卡上使用
50%待验证Qwen-Image-2.1 的视觉生成部分仅有 7B 参数
50%