Qwen 开源 Qwen-Image-2.1:统一生成与编辑并支持透明图像
先了解这件事
2026 年 9 月 20 日,阿里 Qwen 团队开源图像模型 Qwen-Image-2.1,将文生图与图像编辑统一到同一模型,视觉生成组件仅 7B 参数,并原生支持透明图像(RGBA)的生成与编辑。模型支持最多 10 张参考图、圆形/涂鸦/独立蒙版指定局部编辑,通过混合粒度注意力架构与 KV cache 复用提升推理效率,同时改进文字渲染、人像光照与人物产品保真度,覆盖全景图、信息图、分镜与虚拟试穿等任务。模型已上架 GitHub、HuggingFace 和 ModelScope,并获 vLLM-Omni 首日支持与 ComfyUI 支持。关于参数规模,早先报道称视觉生成组件为 7B,后续报道称由 7.1B DiT 搭配 Qwen3-VL-8B 组成;9 月 22 日 MarkTechPost 又称其为 7B 单流 DiT 搭配 8B Qwen3-VL 编码器。The Decoder 称团队在其自建基准上超过多数闭源模型,独立基准尚待验证,并可在 RTX 3090 等消费级 GPU 上运行。9 月 21 日,Qwen 补充称生成与编辑共用单一检查点,模型自带提示词增强 LLM,已集成 diffusers 和 ComfyUI,并在 Hugging Face Spaces 提供浏览器在线 demo;同日 SGLang-Diffusion 宣布 Day-0 支持,覆盖文生图、多图编辑与透明 RGBA 输出。9 月 22 日,Qwen 宣布获 Intel 的 OpenVINO Day-0 支持,可在 Intel 硬件上优化运行。9 月 22 日晚,Arena 称该模型在 Image Edit Arena 以 1367 分位列开源第一、总榜第 16,并登上 Text-to-Image Arena 开源第一;9 月 23 日,Unsloth 发布 Dynamic GGUF 量化版,称可在 12GB 显存本地运行。9 月 23 日,Qwen 官方确认该模型在 Arena 的 Image Edit Arena 与 Text-to-Image Arena 均为开源第一,并邀请用户体验。
AI 根据报道生成 · 3 小时前更新
事件进展
- 9月23日 09:24 · 1 篇报道Qwen-Image-2.1 登顶 Arena 图像编辑与文生图开源榜第一通义千问 / Qwen:Qwen-Image-2.1 登顶 Arena 图像编辑与文生图开源榜第一
- 9月23日 00:14 · 1 篇报道Unsloth 发布 Qwen-Image-2.1 GGUF 量化版,12GB 显存可本地运行Unsloth:Unsloth 发布 Qwen-Image-2.1 GGUF 量化版,12GB 显存可本地运行
- 9月22日 12:08 · 1 篇报道Qwen-Image-2.1 获 OpenVINO Day-0 支持通义千问 / Qwen:Qwen-Image-2.1 获 OpenVINO Day-0 支持
- 9月21日 10:50 · 1 篇报道SGLang-Diffusion Day-0 支持 Qwen-Image 2.1,支持文生图、多图编辑与透明 RGBA通义千问 / Qwen:SGLang-Diffusion Day-0 支持 Qwen-Image 2.1,支持文生图、多图编辑与透明 RGBA 输出
- 9月20日 22:28 · 1 篇报道Qwen-Image-2.1 上线 Hugging FaceAK:Qwen-Image-2.1 上线 Hugging Face
- 9月20日 20:00 · 11 篇报道Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像Qwen:Blog Retrieval:Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像
报道时间线
沿着报道,了解事件的不同侧面。
- X:通义千问 / Qwen (@Alibaba_Qwen)精选Qwen-Image-2.1 登顶 Arena 图像编辑与文生图开源榜第一
通义千问宣布 Qwen-Image-2.1 在 Arena 的 Image Edit Arena 和 Text-to-Image Arena 均为开源模型第一。引用内容显示其 Image Edit Arena 得分 1367,总榜第 16,距第 15 名 GPT-Image-1.5-high-fidelity 仅 3 分,官方邀请用户体验该模型。
- X:Unsloth (@UnslothAI)Unsloth 发布 Qwen-Image-2.1 GGUF 量化版,12GB 显存可本地运行
Unsloth 发布 Qwen-Image-2.1 的 Dynamic GGUF 量化版本,让这个 7B 文生图加编辑模型可在 12GB 显存上本地运行,并称其表现与 Nano Banana 2.0 相当。
- X:Arena (@arena)Qwen-Image-2.1 开源发布,登顶 Arena 图像编辑榜开源第一
通义千问发布 Qwen-Image-2.1,开放权重,在 Arena Image Edit Arena 以 1367 分位列开源第一、总榜第 16,距第 15 名 GPT-Image-1.5-high-fidelity 仅 3 分,同时登上 Text-to-Image Arena 开源第一。
- X:通义千问 / Qwen (@Alibaba_Qwen)Qwen-Image-2.1 获 OpenVINO Day-0 支持
来自 @inteldevs 的 Day-0 OpenVINO 支持!🥳 Qwen-Image-2.1 已可在 Intel 硬件上优化运行。一个开放权重 checkpoint,同时支持生成和编辑。👇
- MarkTechPost阿里通义千问发布 Qwen-Image-2.1:7B 开源权重图像生成与编辑模型
阿里 Qwen 团队发布 Qwen-Image-2.1,将文生图与图像编辑统一到一个 7B 单流 DiT 模型中,搭配 8B Qwen3-VL 编码器,支持原生 RGBA 透明输出和最多 10 张参考图编辑。
- X:通义千问 / Qwen (@Alibaba_Qwen)SGLang-Diffusion Day-0 支持 Qwen-Image 2.1,支持文生图、多图编辑与透明 RGBA 输出
SGLang-Diffusion 发布对 Qwen-Image 2.1 的 Day-0 支持,覆盖文本生成图像、多图编辑和透明 RGBA 输出,单 checkpoint 即可完成。
- X:通义千问 / Qwen (@Alibaba_Qwen)精选通义千问发布 Qwen-Image-2.1:7B 单检查点同时支持图像生成与编辑
通义千问发布 Qwen-Image-2.1,一个 7B 参数的原生图像生成与编辑模型,生成和编辑共用单一检查点,最多支持 10 张参考图。模型自带提示词增强 LLM,已集成 diffusers 和 ComfyUI,并在 Hugging Face Spaces 提供免安装的浏览器在线 demo:https://huggingface.co/spaces/hugging-apps/qwen-image-2-1
- The Decoder:AI News阿里 Qwen 团队发布开源权重图像生成模型 Qwen-Image-2.1,仅 7B 参数
阿里 Qwen 团队发布开源权重图像生成与编辑模型 Qwen-Image-2.1,视觉生成部分仅 7B 参数,团队称在其自建基准上超过多数闭源模型,独立基准尚待验证,可在 RTX 3090 等消费级 GPU 上运行。
- Hacker News 热门(buzzing.cc 中文翻译)Qwen 开源 Qwen-Image-2.1:7B 视觉生成组件统一图像生成与编辑
Qwen 开源 Qwen-Image-2.1,在单一模型中统一文生图与图像编辑,视觉生成组件仅 7B 参数,并原生支持透明图像的生成与编辑。模型支持最多 10 张参考图、圆圈涂画和独立掩码指定局部编辑,通过混合粒度注意力与 KV cache 复用提升推理效率,并改进了文字排版、人像光照和人物产品一致性。
- X:AK (@_akhaliq)Qwen-Image-2.1 上线 Hugging Face
Qwen-Image-2.1 已在 Hugging Face 上线 app:https://huggingface.co/spaces/akhaliq/Qwen-Image-2.1
- X:通义千问 / Qwen (@Alibaba_Qwen)精选Qwen-Image-2.1 已支持 ComfyUI,开源权重开放下载
Qwen 宣布 Qwen-Image-2.1 现已支持 ComfyUI,权重开放。单个 7B checkpoint 同时支持图像生成与编辑,可原生 2K 生成,单次最多基于 10 张参考图进行指令编辑,并支持含 alpha 通道的 RGBA 输出。
- X:通义千问 / Qwen (@Alibaba_Qwen)通义千问发布 Qwen-Image-2.1,vLLM-Omni 提供首日支持
通义千问发布 Qwen-Image-2.1,vLLM-Omni 提供 day-0 支持。该模型可在一个模型内完成图像生成、编辑和透明图像输出,由 7.1B DiT 搭配 Qwen3-VL-8B 组成,设置和受支持的组合见 https://recipes.vllm.ai/Qwen/Qwen-Image-2.1。
- Hacker News:AI 热帖通义千问开源 Qwen-Image-2.1,统一图像生成与编辑并原生支持透明图像
Qwen 团队开源 Qwen-Image-2.1 图像模型,将文生图与图像编辑统一在单一模型中,视觉生成组件仅 7B 参数,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图、圆形/涂鸦/掩码指定局部编辑、人物与产品保真,并通过混合粒度注意力与 KV cache 复用提升推理效率,还改进了文字渲染与人像光照细节。
- X:通义千问 / Qwen (@Alibaba_Qwen)通义千问发布 Qwen-Image-2.1 并开放权重
通义千问发布 Qwen-Image-2.1,定位为 Qwen-Image 系列中均衡且高性价比的图像生成模型,现已开放权重。该模型为生成与编辑一体化的 7B 轻量架构,原生支持生成和编辑 RGBA 透明图层,编辑支持最多 10 张参考图和精确局部控制,并擅长全景图、信息图和虚拟试穿等场景。
- IT之家阿里千问开源 Qwen-Image-2.1 图像模型,支持透明图像与最多 10 张参考图
阿里千问开源图像模型 Qwen-Image-2.1,将文生图与图像编辑整合在同一模型中,视觉生成部分仅 7B 参数,原生支持透明图像的生成与编辑。更新亮点包括轻量结构与推理优化、支持最多 10 张参考图的局部编辑与人像商品保真,以及文字排版和人物光影表现提升,模型已上架 GitHub、HuggingFace 和 ModelScope。
- Qwen:Blog Retrieval精选Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像
Qwen 团队开源 Qwen-Image-2.1,将文生图与图像编辑统一到一个模型中,视觉生成组件仅 7B 参数,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图、圆形/涂鸦/独立蒙版指定局部编辑,通过混合粒度注意力架构和 KV cache 复用提升推理效率,同时改进文字渲染、人像光照与人物产品保真度,并覆盖全景图、信息图和分镜等任务。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。