具身推理模型 Perceptron Mk1.5 上线 OpenRouter,支持多模态空间感知与标注
具身推理模型Perceptron Mk1.5上线OpenRouter,支持多模态输入并能进行空间点框等多维标注。
AI 深度解读
具身推理模型 Perceptron Mk1.5 正式上线聚合平台 OpenRouter,为物理空间感知与机器人智能体开发提供了标准化的云端推理接口。
- 该模型支持文本、图像、视频和音频四模态输入,并能输出坐标点、边界框、多边形以及视频切片等多模态空间标注数据。
- 相较 Mk1 版本,Mk1.5 新增了音频输入支持、视频目标追踪以及工具调用能力。
- 模型提供从无推理到高推理的分级思考机制(graded reasoning),支持结构化输出并具备 36K 上下文窗口。
- 影响/看点:这可能降低物理智能体开发者在多模态感知标注与空间推理上的接入门槛,其在现实场景中的有效性将取决于空间几何标注的精确度与多模态流式推理的延迟控制。
- 资料依据:
- X:OpenRouter (@OpenRouter)(2026-09-25):https://x.com/OpenRouter/status/2103545324598091781
本内容由 AI 生成,仅供参考,请注意甄别