Reka发布Rho-1:统一处理文本、视频与机器人动作的19B多模态模型

📡 MarkTechPost2026-10-06 14:45

Reka发布19B多模态模型Rho-1,可统一理解和生成文本、图像、视频,并输出机器人动作。

AI 深度解读

MarkTechPost2026年10月5日报道称,Reka 发布 Rho-1 研究预览版,这是一个参数规模为19B、尝试在同一模型中处理文本、图像、视频理解与生成以及机器人动作输出的多模态系统,关注价值在于它把通常由多个专用模型组成的流程合并到单一上下文中。

  • 报道称,Rho-1 使用离散 token 表示文本和高层命令,使用连续 token 表示图像、视频及机器人动作。
  • Reka 报告的测试包括图像绘制、框选、视频编辑和文本解释,但这些展示属于厂商研究材料或媒体转述,不是独立基准。
  • 报道给出基础版和蒸馏版的生成速度数据,并明确指出相关测试由 Reka 内部完成。
  • 单模型方案可能减少模型间传递和重复编码,但也会把训练、推理资源和安全验证集中到同一系统。
  • Reka 的官方 GitHub 组织页显示其维护多模态评测及 API 相关项目,但该页面未提供 Rho-1 的独立评测结果。
  • 影响/看点:如果后续开放模型、论文或第三方测试能够复现实验结果,Rho-1 可能降低部分多模态流水线的编排复杂度;实际价值取决于开放程度、任务可靠性、推理成本和机器人控制安全性。资料依据:
  • MarkTechPost(2026-10-05):https://www.marktechpost.com/2026/10/05/reka-releases-rho-1-a-19b-omni-reasoning-model-that-understands-generates-video-and-outputs-robot-actions-in-one/
  • Reka AI GitHub(2026-10-06):https://github.com/reka-ai

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com →
AI 助手