阿里千问开源 Qwen-Image-2.1 图像模型:原生支持透明图生成编辑与多图参考
阿里开源 7B 图像模型 Qwen-Image-2.1,整合文生图与编辑功能并原生支持透明图像。
AI 深度解读
阿里通义千问团队开源图像生成与编辑模型 Qwen-Image-2.1,视觉生成部分采用 7B 参数规模并原生支持透明通道处理。
- 创改一体:将文生图与图像编辑整合于单一架构,视觉生成核心参数为 7B,兼顾生成效果与推理计算开销。
- 原生透明处理:支持依据文本直接生成带有透明背景的图像,并具备原生图层编辑与抠图处理能力。
- 多图参考编辑:单次任务支持最多 10 张参考图像输入,用于提升人像、商品特征保真度及局部复杂编辑。
- 排版与画质:针对文字渲染排版、人物光影及图像细节表现进行了结构优化,代码与权重已在 GitHub、Hugging Face 与 ModelScope 同步发布。
- 影响/看点:轻量化参数结合原生透明图与多图参考特性,意味着该模型能更低门槛地集成至电商素材设计与前端图形制作管线中,但批量商用仍取决于其在复杂提示词下的局部可控度。
- 资料依据:
- IT之家(2026-09-20):https://www.ithome.com/1/004/989.htm
- GitHub QwenLM 代码仓(2026-09-20):https://github.com/QwenLM/Qwen-Image-2.1
本内容由 AI 生成,仅供参考,请注意甄别