阿里云Qwen3.8-Flash上线GMI Cloud,系Qwen4架构前瞻预览
阿里云在GMI Cloud上线多模态MoE模型Qwen3.8-Flash,作为Qwen4架构的早期预览。
AI 深度解读
阿里云于2026年8月28日宣布多模态MoE模型Qwen3.8-Flash正式上线算力平台GMI Cloud,作为下一代Qwen4架构的技术前瞻供开发者接入测试。
- 架构前瞻与定位:阿里云官方说明显示,Qwen3.8-Flash采用多模态混合专家架构,是Qwen4架构体系的早期技术预览版本。
- 多渠道API供给:除GMI Cloud平台外,阿里云同步在阿里云百炼(Model Studio)以及Qwen Cloud平台开放了该模型的API接口。
- 性能与测试目标:该版本重点面向轻量化高吞吐场景与多模态任务,供开发者和企业提前验证其推理响应速度与多模态对齐表现。
- 影响/看点:Qwen3.8-Flash的上线意味着通义团队开始向公有云与算力生态逐步验证Qwen4的设计路径,若其在推理吞吐与算力消耗上展现出优势,可能为后续完整版Qwen4的架构定型与商业定价提供参考依据。
- 资料依据:
- 1. 阿里云官方X公告(2026年8月28日):https://x.com/alibaba_cloud/status/2093226022623957372
- 2. 阿里云百炼Model Studio平台(2026年8月28日):https://click.alibabacloud.com/m/20000002820/
- 3. Qwen Cloud开发者平台(2026年8月28日):https://click.qwencloud.com/m/20000002828/
本内容由 AI 生成,仅供参考,请注意甄别