商汤开源多模态模型 SenseNova U1.5-Lite-Preview,原生支持 4K 图像生成
商汤开源轻量级多模态模型SenseNova U1.5-Lite-Preview,仅8B规模原生支持4K图像生成与编辑
AI 深度解读
商汤科技开源了轻量级统一多模态模型 SenseNova U1.5-Lite-Preview,主打原生 4K 图像生成能力,且模型体量做得很小,是国产开源图像生成模型的一次务实迭代。
- 模型规模仅为 8B-MoT(混合训练),体量轻量却号称能在图像生成与编辑质量上比肩商用闭源模型
- 相比前代 U1,新版本原生支持 4K 分辨率图像生成,细节和真实感明显提升
- 中英文文字生成与复杂版式排布的准确度得到加强,这是图像生成模型此前普遍的弱项
- 图像编辑和视觉指令遵循的稳定性也有提升,操控生成结果更可控
- 已同步开源到 GitHub、Hugging Face 和魔搭社区,可直接下载使用
- 看点:用 8B 级别的小模型去够闭源商用模型的图像生成质量,如果实测效果属实,会显著降低中小团队做图像生成应用的部署门槛。
本内容由 AI 生成,仅供参考,请注意甄别