智谱开源原生多模态模型 GLM-5.3-Flash,硅基流动上线首发推理支持
智谱开源多模态模型GLM-5.3-Flash,总参数320B且激活仅18B,硅基流动同步上线推理支持。
AI 深度解读
智谱 AI 于 2026 年 8 月 27 日正式开源原生多模态模型 GLM-5.3-Flash(此前盲测代号为 Ox-Alpha),算力平台硅基流动(SiliconFlow)同步上线首发生产级推理支持。
- 模型总参数量为 320B,实际推理仅需激活 18B 参数,采用混合稀疏与线性注意力架构,基于宽松的 MIT 许可协议开源模型权重。
- 官方基准测试显示其综合表现优于前代 GLM-5.2 且推理开销降低 90%;在代码生成与智能体任务上的表现贴近 Claude Opus 4.8,而调用成本相比后者降低超过 95%。
- 硅基流动平台上线了针对该稀疏多模态架构优化的推理服务,为企业级开发者提供高可用 API 与高并发吞吐保障。
- 影响/看点:以极低激活参数实现接近顶尖大模型编程能力的开源设计,如果在多模态理解与长文本推理中保持一致稳定性,意味着中小企业和独立开发者将能以更低硬件成本部署高可用智能体与辅助编程系统。
- 资料依据:硅基流动 SiliconFlow 官方发布(https://x.com/SiliconFlowAI/status/2092966798136414242)
本内容由 AI 生成,仅供参考,请注意甄别