通义千问官方发布 Qwen3.8-Flash 开源权重:125B 多模态 MoE 架构

📡 通义千问 / Qwen2026-08-26 20:34

通义千问开源多模态MoE模型Qwen3.8-Flash,总参数125B仅激活6B,原生支持262K上下文并可扩展至1M。

AI 深度解读

阿里巴巴通义千问团队于2026年8月26日正式开放多模态混合专家模型 Qwen3.8-Flash 的模型权重,作为下一代 Qwen4 架构的早期技术预览,展示了在低激活参数下处理复杂任务的技术路径。

  • 模型采用多模态混合专家(MoE)结构,总参数量达 125B,但在每个 token 的推理计算中仅激活 6B 参数,有效降低了计算与显存带宽开销。
  • 根据通义千问官方博客于2026年8月26日发布的技术细节,该模型引入了 Gated DeltaNet 线性注意力与 Qwen 稀疏注意力(QSA)混合机制,支持原生 262K 上下文并可通过 YaRN 扩展至 1M。
  • 官方数据显示其训练成本仅为前代 Qwen3.7-Plus 的九分之一,在代码编写与日常办公等实用场景中展现出更高的推理效率与输出质量。
  • 模型内置了多档深度可调的思考模式,并原生支持图像与视频等多模态输入解析。
  • 影响/看点:该模型的开源可能为资源受限环境下部署高性能多模态智能体提供更经济的可行解,其技术价值的最终兑现取决于社区在实际复杂长文本场景中的吞吐表现与显存卸载适配成熟度。
  • 资料依据:
  • 1. 通义千问官方 X 账号:https://x.com/Alibaba_Qwen/status/2092591393424515114
  • 2. Qwen 官方技术博客(2026年8月26日):https://qwen.ai

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手