DeepSeek-V4-Flash-0731 正式版上线,智能体与代码能力大幅提升
DeepSeek-V4-Flash-0731正式版上线,智能体与代码能力较预览版大幅提升,API转为公测
AI 深度解读
DeepSeek 在 7 月 31 日把 DeepSeek-V4-Flash-0731 从预览版扶正为正式版,同步在 Hugging Face 开源权重并将 API 转为公测,官方明确这是取代此前预览版的正式发布,架构和参数规模保持不变,提升主要来自重新做后训练而非改架构。
- 模型自带 DSpark 投机解码模块,Hugging Face 显示仓库参数为 3040 亿(其中基础模型 2840 亿,叠加了这个解码模块)
- API 端原生支持 Responses API 格式并适配 Codex,但 V4-Pro 的 API 以及 App/网页端模型这次没有同步更新
- 走 API 调用门槛极低:输入 token 缓存未命中每百万 0.14 美元、命中仅 0.0028 美元,输出每百万 0.28 美元,大约是 V4-Pro 输出价格的三分之一,种子期创业公司和个人开发者不用 GPU 预算也能跑智能体循环
- 自托管门槛则高得多:权重 MIT 协议无门槛下载,但由于是 MoE 架构每个专家都要常驻内存(尽管每 token 只激活 130 亿参数),8 比特无损版本达 162GB,3 比特版本也要 103GB,需要约 110GB 的显存加内存总量
- 架构上采用 2840 亿参数 MoE(每 token 激活 130 亿)、100 万 token 上下文,混合了压缩稀疏注意力(CSA)和重压缩注意力(HCA),用流形约束超连接替代传统残差连接
- 看点:这次更新证明了“不改架构、只做后训练”也能带来明显的智能体和代码能力提升,同时官方给出的定价把智能体循环的调用成本压到了几乎人人可负担的水平,是目前最具性价比的开源智能体底座之一。
本内容由 AI 生成,仅供参考,请注意甄别