谷歌于7月30日发布GeminiRobotics2,标志着具身智能领域迎来“安卓”时刻,成为支撑下一代自适应机器人的智能底层。GeminiRobotics2首次将模型控制范围扩展至人形机器人全身,实现了三大核心能力:智能全身运动控制、高阶灵巧操作与多机器人协同作业。
核心架构分为两部分:
- GeminiRobotics2(执行层):采用跨本体VLA模型,将视觉、语言输入转化为动作指令,可适配各类机器人。
- GeminiRoboticsER2(推理层):本质为具身推理模型(VLM),实现人机交互、理解物理世界、长程任务规划及多机器人协同。
此次发布的关键意义在于推动具身智能从局部控制向全身协同演进,为未来机器人应用奠定智能基础。