阿里开源 Qwen3.8-Flash:125B 总参数仅激活 6B,预览 Qwen4 架构
阿里开源Qwen3.8-Flash,总参数125B仅激活6B,在SWE-bench Pro测试中取得62.5分超越Claude Opus。
AI 深度解读
开源社区与行业评测关注到阿里最新公开的 Qwen3.8-Flash 架构细节,其通过创新的参数扩容设计在基准测试中展现出与高计算量模型竞争的潜力。
- 架构设计上,模型在 125B 基础参数(单 token 仅激活 6B)之外,额外引入了 51B 参数的 N-gram 嵌入表,通义千问团队官方资料显示该设计旨在以较低计算成本扩充容量并便于在主机内存等存储层进行卸载。
- 在实际基准测试中,该模型在软件工程评测 SWE-bench Pro 上取得 62.5 分,高于 Claude Opus 4.6 Max 的 53.4 分。
- 官方披露其训练成本仅为 Qwen3.7-Plus 的九分之一,显示出稀疏激活与残差流门控等结构改进对训练与推理能耗的压缩效果。
- 该模型被定位为 Qwen4 架构的早期验证版本,为下一代开源基础模型在编码与智能体工作流中的效率优化提供了先期验证。
- 影响/看点:低激活参数配合外部嵌入扩展的模式可能改变大模型本地部署的硬件门槛,但其在工业级软件工程中的真实可用性仍取决于模型在非标准化代码库与多步骤调试中的持续鲁棒性。
- 资料依据:
- 1. 阿易 AI Notes X 发帖:https://x.com/AYi_AInotes/status/2092611066375061607
- 2. Qwen 官方技术博客(2026年8月26日):https://qwen.ai
- 3. SWE-bench 官方评测收录(2026年8月):https://ollama.com
本内容由 AI 生成,仅供参考,请注意甄别