Liquid AI 发布无需输出文本的开放权重多模态决策模型
Liquid AI发布两个开放权重多模态决策模型,仅返回校准后的类型化答案,不生成文本。
AI 深度解读
Liquid AI 于2026年10月7日发布开放权重的 d1-3B 与 d1-omni-600M,面向文本、图像和音频输入,重点在于用一次前向计算直接返回结构化决策,而不是逐词生成答案。
- Liquid AI 博客(2026-10-07)称,d1-3B 参数量约30亿,支持文本与图像;d1-omni-600M 约6亿参数,可处理文本加图像或文本加音频。
- 模型返回是、否、选项概率分布或有序评分等结果,输出标记数为零,适合分类、路由、审核和评分等任务。
- 官方公开的基准中,d1-3B 在 Decision Index v0.2.1 得分为48.57,并报告其在 RTX 4090 上单问题延迟为8毫秒;这些数据来自厂商测试,不能直接等同于所有部署环境的性能。
- 官方称两个模型已在 Hugging Face 提供,并支持 Transformers、llama.cpp 等工具;d1-omni-600M 仍被标注为实验性版本,且官方未给出其完整延迟数据。
- 影响/看点:这类模型可能减少结构化决策场景中的生成与解析开销,但实际价值取决于任务分布、校准质量、硬件环境以及开放许可和模型卡对使用边界的说明。
- 资料依据:
- Liquid AI《Open d1: Edge decision models for text, vision, and audio》(2026-10-07):https://www.liquid.ai/blog/d1-open
- Liquid AI《Liquid Foundation Models》文档(2026-10-07):https://docs.liquid.ai/lfm/models/complete-library
本内容由 AI 生成,仅供参考,请注意甄别