谷歌近日正式发布了Gemini Robotics 2.0,这是其基于Gemini AI模型驱动的机器人技术重大升级。新版本通过三款子模型,显著提升了物理机器人的能力,使其能够完成更复杂的任务、持续分析变化的环境,并与其他机器人高效协作。其中一款子模型即日起对开发者开放,标志着谷歌在通用机器人领域迈出关键一步。
核心升级在于Gemini Robotics 2.0引入了“全身智能”概念。谷歌DeepMind团队表示,新系统能控制完整的人形机器人,包括具有复杂结构的人手,大幅提升灵巧性。演示视频中,机器人展示了跑步、跳舞甚至后空翻等动作,但这些并非预设的单一任务,而是基于AI实时决策的结果。谷歌的目标是打造“通用机器人”——一种能像人类一样执行任何任务的机器,DeepMind科学家有时称之为“物理AGI”。用户只需下达指令,机器人便能自主完成。新版本中的Gemini Robotics ER 2是升级版“具身推理”模型,相比前代1.6版本有显著飞跃,并已集成到Gemini Live API中,开发者可立即接入使用。
这一发布对机器人行业和AI应用具有深远影响。首先,Gemini Robotics 2.0提升了机器人的安全性和适应性,通过持续环境分析,机器人能更可靠地应对动态场景,减少意外风险。其次,开放开发者API将加速创新,从工业自动化到家庭服务,机器人有望在更多领域替代人类完成精细操作。然而,通用机器人的普及也引发伦理与就业担忧,谷歌需在技术突破与负责任部署间平衡。总体而言,Gemini Robotics 2.0标志着AI从虚拟助手向物理世界延伸的重要里程碑,未来几年或重塑人机协作模式。
