DeepSeek V4.1 Flash 模型上线国家超算互联网平台
DeepSeek V4.1 Flash 模型上线国家超算互联网平台并开放 API 调用,采用 MoE 架构大幅降低成本。
AI 深度解读
DeepSeek V4.1 Flash 模型于 2026 年 9 月 10 日上线国家超算互联网平台并开放 API 服务,为开发者提供了兼顾低推理开销与高吞吐的算力接入渠道。
- 架构设计采用 Causal-Encoder-Decoder 结构,总参数量为 552B 的 MoE 模型,输入激活参数量为 8B,输出激活参数量为 16B。
- 模型结合了改进的预训练方式与更大规模强化学习后训练,在基准测试表现上超过 DeepSeek V4 Pro。
- 优化了 KV Cache 占用,相比上一代模型,HBM 需求降至 1/4,SSD 需求降至 1/8,降低了 Agent 场景下的缓存与推理开销。
- 影响/看点:该模型上架国家级算力平台,意味着非对称激活架构与缓存压缩技术可能进一步降低长上下文应用的部署门槛,但其实际吞吐表现与稳定性仍取决于平台算力调度的承载能力。
- 资料依据:
- IT之家(2026-09-10):https://www.ithome.com/1/000/976.htm
- 国家超算互联网(2026-09-10):https://www.scnet.cn/ui/mall/model-detail.html?modelId=deepseek-v4.1-flash
- DeepSeek官方(2026-09-10):https://api-docs.deepseek.com/news/2026-09-10-v4-1-flash
本内容由 AI 生成,仅供参考,请注意甄别