通义千问或将发布 Qwen3.8-Flash-Next:采用 Qwen4 架构,激活参数仅 6B
通义千问即将发布基于 Qwen4 架构的 Qwen3.8-Flash-Next,总参数 176B 但激活参数仅 6B。
AI 深度解读
开源社区技术博主于 2026 年 8 月披露阿里云 ModelScope 平台曾短暂上线 Qwen3.8-Flash-Next 页面,该模型作为 Qwen4 架构的预览版,展现了阿里云在大参数与超低激活计算量混合专家(MoE)结构上的最新探索。
- 架构设计:信息显示该模型采用多模态 MoE 架构,总参数量约为 176B(由 125B 主网络参数与 51B N-gram 嵌入层构成)。
- 稀疏激活特性:在处理每个 token 时仅激活约 6B 参数,试图在保持超大模型表征能力的同时压低推理计算成本与延迟。
- 版本定位:该模型被标注为通义千问下一代 Qwen4 架构的早期技术验证版本,重点面向高吞吐、低延迟的轻量级调用场景。
- 影响/看点:若 6B 激活参数能支撑起接近百亿级乃至千亿级密集模型的基准得分,意味着多模态大模型在端侧和云端轻量化推理上的性价比将显著提升,其成立条件取决于官方最终发布时的实测精度与显存占用优化水平。
- 资料依据:
- 1. X 平台技术博主 @kimmonismus 爆料(2026 年 8 月):https://x.com/kimmonismus/status/2092541014183461369
本内容由 AI 生成,仅供参考,请注意甄别