谷歌发布Gemini Robotics 2 机器人获全身智能

新闻速览

谷歌DeepMind于2026年7月28日发布Gemini Robotics 2,宣称将全身智能引入机器人系统。这一发布源于具身智能热潮下,厂商将多模态大模型与机器人控制深度融合,旨在解决机器人在复杂环境中动作协调与泛化能力不足的痛点。初步影响是加速了人形机器人从实验室走向真实场景的进程,并可能重塑工业与服务机器人的技术路线。

背景

Gemini Robotics 2的推出正值大模型能力向物理世界延展的关键阶段。此前多模态模型主要停留在数字界面,而机器人行业长期受限于单一任务编程与笨拙的运动控制。DeepMind基于Gemini系列模型积累的视觉-语言理解能力,进一步打通感知到动作的映射闭环。同时,机器人数据采集成本下降、仿真训练技术成熟,以及来自商业人形机器人公司的竞争压力,共同促成了这款强调全身协同的模型面世。

深度解读

Gemini Robotics 2让刘工看到机器人行业正在从“四肢发达”转向“全身有脑”。过去我们习惯把感知、规划、控制拆成独立模块,就像让不同部门接力传话,而这次直接端到端揉进一个模型,效率提升是代际级的。对比特斯拉Optimus沿用的视觉+规则混合方案,DeepMind更激进地押注大模型一统全程。短期看,发布意义可能夸大,因为真实环境测试还没全面铺开;但长期看,这种路线一旦跑通,会让机器人适应陌生场景的成本大幅下降。下一步值得关注的不是演示视频多炫,而是它能否在未见过的环境里持续稳定工作,以及谷歌会不会借Android生态快速铺开开发者合作。

延伸思考

延伸思考

  • 全身智能将如何重构机器人从感知到执行的决策链路
  • Gemini Robotics 2对现有机器人数据采集与训练范式可能带来的改变
  • 多模态大模型在物理世界落地时,安全性与伦理边界如何界定

来源与原文

本条动态来自 DeepMind Blog(发布于 2026-07-28 13:21:37)。本站为海外 AI 动态的中文转述与观点评论,原文版权归原作者所有。


每日聚合海外 AI 一手动态与深度观点。收藏本站,不错过每一个重要信号;返回首页查看更多。

Leave a Reply

您的邮箱地址不会被公开。 必填项已用 * 标注

中文EN