Google DeepMind 近日宣布推出新一代物理人工智能系统 Gemini Robotics 2。该系统旨在为人形机器人赋予“全身智能”,使其具备精细的操控能力以及多机器人协作等高级功能。
此次技术突破由三款全新的模型共同驱动:其中,核心模型 Gemini Robotics 2 是一款视觉-语言-动作(VLA)模型,能够实现从足部到指尖的全身协同控制;Gemini Robotics ER 2 则专注于复杂逻辑,能够理解真实世界的视频信息并进行多步骤的复杂任务规划;而 On-Device 2 则侧重于本地化部署,不仅能在设备本地运行,还能在短短数小时内快速适应全新的机器人本体。