💬 观点Google DeepMind
Gemini Robotics ER 2: powering robotics with video — 谷歌DeepMind发布Gemini Robotics ER 2,提升机器人视频
谷歌DeepMind发布Gemini Robotics ER 2,提升机器人视频理解与多机协作能力。
2026-07-30原文
本文为要点摘要,完整细节以原文为准。
🧭 一图看懂
由原文自动提炼 · 以原文为准点击任一分支,查看这一点的一句话解读
Gemini Robotics ER 2 机器人视…
充当机器人的高层大脑,负责推理与任务编排,把动作执行交给底层 VLA 模型
- 支持实时空间推理与多步任务规划
- 可原生调用 Google Search 等工具
- 边执行边思考下一步
⚙️ 流程拆解
STEP 1声明底层控制接口为工具
STEP 2流式输入视频音频文本
STEP 3模型推理并规划多步任务
STEP 4调用 VLA 或导航 API 执行
STEP 5视频追踪进度并纠错
🔗 涉及的概念与玩家
- Gemini Robotics ER 2模型
- Google DeepMind公司
- Gemini API产品
- Gemini Live API产品
- Boston Dynamics公司
- Apptronik公司
- VLA概念
- Gemini Robotics ER 1.6模型
- Google DeepMind—发布→Gemini Robotics ER 2
- Gemini Robotics ER 2—升级自→Gemini Robotics ER 1.6
- Gemini Robotics ER 2—可通过→Gemini API
- Gemini Robotics ER 2—集成于→Gemini Live API
- Gemini Robotics ER 2—调度→VLA
- Gemini Robotics ER 2—驱动→Boston Dynamics
- Gemini Robotics ER 2 在视频理解上实现阶跃式提升,使机器人能更精准地解析动态场景,为复杂任务执行提供基础。
- 该模型强化了工具编排能力,机器人可灵活调用多种工具完成操作,对开发者意味着更高效的机器人控制逻辑。
- 支持多机器人协作,多个机器人能协同完成复杂任务,这为工业自动化与多智能体系统开发开辟了新路径。
原文:Gemini Robotics ER 2: powering robotics with video understanding, task orchestration, and multi-robot collaboration · 作者 Google DeepMind
🕸 顺着图谱继续读
- Gemini Omni 1.1 Flash lets you build with more control — Gemini Omni 1.1 Flash 发布,强调开发者可控性与实时交互能力2026-08-27 · 共同涉及 Google DeepMind、Gemini API
- Introducing Gemini 3.7 Flash — Google DeepMind 发布 Gemini 3.7 Flash,主打低延2026-08-13 · 共同涉及 Google DeepMind、Gemini API
- Start building with Nano Banana 2 Lite and Gemini Omni — Google DeepMind 发布 Nano Banana 2 Lite 和 2026-06-30 · 共同涉及 Google DeepMind、Gemini API
- Introducing computer use in Gemini 3.5 Flash — Gemini 3.5 Flash 新增计算机使用能力,可操控桌面应用。2026-06-24 · 共同涉及 Google DeepMind、Gemini API