通义千问开源 7B 原生图像生成编辑模型 Qwen-Image-2.1,上线在线 Demo

📡 通义千问 / Qwen2026-09-21 10:50

通义千问开源 7B 图像生成与编辑模型 Qwen-Image-2.1,支持单检查点多图编辑并上线在线 Demo。

AI 深度解读

阿里巴巴通义千问团队发布 7B 参数的原生图像生成与编辑模型 Qwen-Image-2.1,通过单一检查点统一了文生图与图像编辑能力,降低了多模态图像生成部署的复杂度。

  • 模型采用 7B 参数规模,单个检查点同时支持文本生成图像和多图编辑,单次编辑最多支持输入 10 张参考图像。
  • 内置提示词增强语言模型,能够自动优化输入描述以提升生成质量与语义对齐度。
  • 生态支持方面已集成至 diffusers 与 ComfyUI 工作流,并在 Hugging Face Spaces 上线免安装在线演示。
  • 影响/看点:单一检查点设计有助于减少视觉创作者在生成与编辑模型间的切换与显存占用,但多图编辑的连贯性与细节保留能力仍取决于复杂构图下的参考图对齐表现。
  • 资料依据:
  • 通义千问官方 X(2026-09-21):https://x.com/Alibaba_Qwen/status/2101866671900401913
  • Hugging Face Spaces(2026-09-21):https://huggingface.co/spaces/hugging-apps/qwen-image-2-1

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手