谷歌 DeepMind 新模型可控制人形机器人全身动作
谷歌 DeepMind 新版 Gemini Robotics 模型使人形机器人可实现全身动作控制,能行走、下蹲、伸展并抓取物品,已在 Apptronik Apollo 2 上演示。
AI 深度解读
《The Verge》对谷歌 DeepMind Gemini Robotics 2 发布的报道,聚焦点更直白:这一代模型第一次真正让人形机器人「全身能动」,而不只是控制上半身。
- 此前的 Gemini Robotics 模型只负责控制人形机器人的上半身动作,新版本首次支持「全身动作」,覆盖从脚到手指的完整运动链
- 官方演示视频显示,Apptronik 的 Apollo 2 机器人可以完成走、蹲、伸展等全身动作,并能弯腰捡起洒水壶、从架子上找到并取出指定物品
- 报道特别提到,谷歌方面并未详细披露这些行为背后的具体训练方法
- 视频里展示的「从货架取物」「弯腰捡物」等动作,都是需要全身协调而非单纯手臂操作才能完成的任务
- 对比前代产品,「上半身→全身」的跨越意味着人形机器人在真实非结构化环境(如仓储、家庭场景)里完成复杂任务的可行性又近了一步,但训练细节的不透明也提示外界目前只能看结果、难判定其泛化能力的真实边界。
本内容由 AI 生成,仅供参考,请注意甄别