谷歌让机器人学会全身协调干活
推荐指数 72.0 NO. 012 · 2026.07.31
发布2026/07/30Score318Comments300
为什么值得看
Gemini Robotics 2 是谷歌 DeepMind 推出的机器人基础模型,实现全身智能控制、精细操作和多机协作,突破传统机器人预编程和单一任务限制。对 AI 工程师意味着具身智能从实验室走向泛化应用的关键节点已至,人形机器人赛道技术栈可能快速收敛到少数几个基础模型。
编辑判断
全身智能控制一直是具身智能的瓶颈——之前Figure AI、特斯拉Optimus的演示多为上半身操作,下半身步态和上肢抓取是割裂控制的。Gemini Robotics 2 把VLM的时空推理能力直接映射到全身关节控制,这暗示谷歌可能在用同一套模型同时处理感知、规划和低层运动控制,省去了传统分层架构的延迟和误差累积。
对创业者的直接影响:做机器人中间件、运动控制SDK的初创公司窗口期在缩短,基础模型层可能直接吃掉这部分价值。但垂直场景的遥操作数据飞轮、特定形态的硬件适配仍有独立机会,尤其是工业场景的安全认证壁垒。
建议关注两个信号:模型是否支持跨机型迁移(原文提到"every shape and size"),以及300条HN评论中是否有实际部署的延迟和稳定性反馈,这决定了它是演示级还是工程级突破。
社区反馈
意见分歧 193 条评论
核心争论:具身智能是临近GPT-2拐点还是仍处GPT-1早期,demo可信度与真实落地差距多大
Wow, what a time to be alive!
I would caution against enthusiasm. Anyone opposing those who end up controlling these robots won't be alive for long.
These robots can't do combat, not effectively anyway, but that's already jumping three stages ahead, because first off, why would they?