Liquid AI 开源 d1 系列多模态决策模型,单次推理仅需 8 毫秒

📡 IT之家2026-10-09 14:29

Liquid AI开源d1系列决策模型,支持文本、图像及语音输入,单次推理最快仅需8毫秒。

AI 深度解读

Liquid AI 于 2026 年 10 月 7 日发布 d1-3B 和 d1-omni-600M 两款开放权重决策模型,分别支持文本图像以及文本、图像和语音输入,关注价值在于小参数模型开始同时强调多模态输入与边缘侧低时延部署。

  • 官方称 d1-3B 在 Decision Index v0.2.1 公开测试集得分 48.57,并称其领先所有参数规模低于 10B 的模型。
  • 官方公布的单问延迟为 RTX 4090 上 8 毫秒、Jetson AGX Thor 上 16 毫秒、Jetson Orin Nano 上 50 毫秒。
  • d1-omni-600M 是实验性检查点,支持文本与图像或文本与语音组合输入,在同一指数上得分为 15.95。
  • 这些延迟来自特定硬件、输入和测试设置,不能直接推导出所有应用中的端到端响应速度。
  • 影响/看点:如果开放权重模型能在真实传感器链路中维持稳定精度,机器人、无人机和本地自动化设备的决策环节可能更容易采用本地推理;关键取决于任务数据、功耗、模型许可和安全冗余是否满足部署要求。
  • 资料依据:
  • Liquid AI(2026-10-07):https://www.liquid.ai/blog/d1-open
  • IT之家(2026-10-09):https://www.ithome.com/1/010/946.htm

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com →
AI 助手