9 月 20 日,阿里巴巴千问团队正式开源图像生成模型 Qwen-Image-2.1。据千问官方博客,该模型把文生图与图像编辑统一进单一模型,视觉生成组件仅 7B 参数,并原生支持透明图像(alpha 通道)的生成与编辑;可接收最多 10 张参考图,强化了局部编辑、人像与商品保真。发布后数小时,国产 GPU 厂商沐曦股份宣布完成对 Qwen-Image-2.1 的 Day 0 适配,实现"上线即适配"。

这条新闻的看点不在模型参数,而在两件事同时发生:一个 7B 参数的开放图像模型试图覆盖此前需要多个专用模型的场景,以及一家国产 GPU 公司把"首发适配"做成了固定动作。据同花顺报道,自 2025 年 12 月以来,沐曦已完成 39 个主流旗舰模型的 Day 0 适配——"模型发布当天就能在国产算力上跑起来"正在从口号变成可核验的例行程序。

先看模型本身。透明图生成是这次更新的关键技术点:此前设计师要抠图、去背景,通常需要额外的工具或后处理管线;原生 alpha 通道意味着模型直接输出带透明通道的图像,编辑与生成在同一次推理里完成。腾讯科技援引的公开评测称 Qwen-Image-2.1 已成为千问图像系列"当前最平衡、性价比最高"的开源生图模型——这个判断基于公开评测与社区复测,属于第三方与厂商口径,而非独立机构认证。

再看生态含义。7B 参数的视觉生成组件意味着推理门槛低,消费级显卡与国产推理栈都能承载;而 Day 0 适配让"开源模型+国产算力"的协同从个案变成机制。两件事合起来的潜台词是:中国 AI 生态正在把"模型开源"与"

[1][2]

算力自主"焊成同一条产品线——模型发布与国产 GPU 适配同步官宣,正在成为新的行业惯例。这对依赖单一厂商推理服务的开发者,是选择面的扩大;对依赖进口 GPU 的算力供应商,是竞争压力的信号。

需要标注的口径边界:透明图生成、10 张参考图等能力来自千问官方博客;"开源生图第一""最平衡性价比最高"来自腾讯科技等媒体转述的公开评测,不是官方排名;沐曦的 39 个模型 Day 0 适配数量来自其自身披露。三者都可溯源,但都别当成独立审计结论。

截至发稿,Qwen-Image-2.1 权重已可通过官方渠道与 ComfyUI 等生态加载。真正值得跟踪的验证点是:7B 模型在真实设计工作流里的编辑质量与透明通道可靠性,以及"Day 0 适配"从宣传词变成可复现基准的速度。开源模型的纪律不变——跑分交给社区,好不好用由工作流投票。

[1][2]
深夜平面设计工作室,设计师的背影坐在双屏前,主屏上一张半透明的人像照片正被分割出独立图层,图层边缘悬浮着半透明的矩形图像碎片,副屏显示调色板与图层列表,台灯暖光与屏幕冷光混合
深夜设计工作室透明图层编辑的编辑级插画, AI 生成插画,非新闻照片