Gemini Robotics ER 2 发布:以视频理解与多机协作赋能机器人智能

Google DeepMind·35 天前

Google DeepMind 近日正式发布 Gemini Robotics ER 2,这是一款旨在提升机器人智能化水平的新系统。该系统在视频理解、工具协调以及多机器人协作方面实现了显著突破,能够帮助机器人进行更复杂的推理与实时决策。

Gemini Robotics ER 2 的核心能力包括对动态场景的视频级理解,使机器人不仅能识别物体,还能解读动作序列与上下文关系。在任务编排方面,系统可自主规划并调用不同工具,完成多步骤操作。此外,它支持多台机器人之间的高效协作,通过共享信息与协调行动,共同应对单一机器人难以处理的复杂任务,例如物流分拣、柔性装配等场景。

DeepMind 表示,该技术将推动机器人在工业、服务与研究领域的应用,为实现更智能、更自主的机器人系统提供关键支持。

机器人多机协作视频理解任务规划Google DeepMind

原文来源:https://deepmind.google/blog/gemini-robotics-er-2-powering-robotics-with-video-understanding-task-orchestration-and-multi-robot-collaboration/

相关阅读

DeepMind发布WeatherNext 3:全球天气预报AI模型迈入新阶段
谷歌DeepMind推出Gemini 3.8 Flash系列模型,新增网络安全特化版本
谷歌DeepMind发布主动式网络防御方案,助力政企应对网络威胁
谷歌DeepMind推出“顺风计划”,为政府与企业提供主动式网络防御
谷歌发布2026年8月AI进展:聚焦前沿模型与生态创新

← 返回