我是 LongbridgeAI,我可以总结文章信息。Alphabet 旗下 Google DeepMind 推出新一代机器人 AI 模型 Gemini Robotics 2,实现人形机器人从头到脚的全身动作协调控制。该模型能同步完成复杂推理与行走、拾取等高难度动作,并配套发布 Gemini Robotics ER 2 与 On-Device 2 以完善软体生态。尽管展示了强大实力,公司仍承认实现真正灵活性面临长期挑战。
Alphabet(GOOGL-US) 旗下 Google DeepMind 于本周正式推出新一代机器人人工智能模型 Gemini Robotics 2,该突破性进展使人形机器人具备了从头到脚的全身动作协调能力,象征著这家科技巨头在将人工智能能力延伸至物理世界的竞赛中,迈出了关键性的一步。
Gemini Robotics 2 最大的技术亮点在于其对人形机器人的控制范畴从过往局限的上半身,扩展至整体的全身控制。这意味著机器人在执行复杂推理任务的同时,能够同步完成行走、蹲伏及灵活操控物体等高难度动作。
在近期向媒体展示的案例中,该模型成功操控 Apptronik 公司的 Apollo 人形机器人,完成了自主绕过障碍物、穿越房间、精准拾取浇水壶并将其放置于低层架子的全流程任务,展现出高度的自主协调性。
与此同时,Google DeepMind 还同步公开了 Gemini Robotics ER 2 与 On-Device 2 两款配套模型。这两款新产品既能独立运作,亦可协同工作,旨在支援机器人规划多步骤任务,并协调多台机器人共同执行作业,进一步完善了其机器人 AI 的软体生态。
尽管此次发布展现了谷歌在实体人工智慧领域的强大实力,但公司内部对技术现状保持著冷静的审视。Google DeepMind 机器人部门副总裁 Carolina Parada 强调,公司的长远目标是将 AI 引入物理世界,并构建一个通用且高效的机器人智慧层。
然而,机器人部门总监 Kanishka Rao 也坦承,追求真正意义上的机器人灵活性依然是一个长期的挑战。
目前,机器人的动作过程仍显得较为缓慢与刻意,因为机器在执行动作前必须停下来处理与思考人类能凭直觉完成的判断,这也为人形机器人的商业化落地进程提供了更为审慎的参考视角。
此次模型发布不仅是谷歌在机器人领域策略的持续深化,更重燃了其长达十余年的机器人雄心。自 2025 年推出首代 Gemini Robotics 以来,谷歌重新确立了将语言与视觉讯息转化为机器人动作的开发方向。
回顾过去,谷歌在机器人领域的布局并非一帆风顺,在经历了 2010 年代初期的密集收购与随后的业务收缩,乃至 2023 年关闭 Everyday Robots 部门后,此次频繁且高强度的技术发布,显示了谷歌在这一赛局上再度升温的投入力度。
随著人工智慧战线的扩大,谷歌在机器人领域面临著激烈的外部竞争。OpenAI 目前正积极探索融合视觉、语言与动作的通用基础模型,而英伟达则透过提供强大的软体工具链,协助开发者训练 AI 驱动的机器人。
在技术竞赛与市场期待的夹击下,谷歌正试图凭借 Gemini Robotics 系列模型,在未来的人形机器人产业中占据技术制高点。
