DeepSeek-V4 Flash Vision Experimental 上线,支持视觉理解与百万上下文
DeepSeek-V4 Flash新增视觉理解能力,已在SiliconFlow上线并支持百万上下文。
AI 深度解读
硅基流动宣布上线 DeepSeek-V4-Flash-Vision-Exp,新增视觉输入并提供百万级上下文,关注价值在于多模态模型是否能以较低调用成本进入长文档与智能体工作流。
- 公告称模型基于 V4 Flash 加入视觉理解能力,并可通过 SiliconFlow 使用。
- SiliconFlow 给出的价格为缓存输入每百万 Token 0.028 美元、输入 0.44 美元、输出 1.32 美元。
- 条目还称模型支持 1M 上下文并采用 MIT 许可,但当前可核验材料主要来自平台方社交账号,尚不足以判断实际视觉质量、稳定性和许可覆盖范围。
- 对开发者而言,百万上下文降低长材料分段处理的需求,但显存、延迟和长上下文有效利用率仍会影响实际成本。
- 影响/看点:若模型的视觉准确率、长上下文召回和服务稳定性达到可用水平,可能扩大国产多模态模型在检索和 Agent 场景的试用;这一判断成立的前提是后续官方文档、权重或独立评测能够验证相关能力。
- 资料依据:
- 硅基流动 SiliconFlow(2026-09-04):https://x.com/SiliconFlowAI/status/2095832456108888217
本内容由 AI 生成,仅供参考,请注意甄别