AMAZINGINDEX.COM 日报快照
52.8
VOL. 2026.07
2026.07.31
← 返回 2026.07.31 日报
日报快照 · Daily Snapshot
NO. 024

VLM具身智能评测新框架

#HF_PAPERS HuggingFace Papers 2026.07.31
推荐指数 63.0 NO. 024 · 2026.07.31
upvotes65comments4

HumanCLAW 用安全绳悬挂真人执行 VLM 指令,将高层决策与低层运动控制解耦,首次能独立判断 VLM 的"脑子"好不好使。对做机器人/具身智能的团队,这意味着终于能定位失败根因是模型决策还是执行层问题。

VLM具身智能评测新框架

之前机器人领域测 VLM 都是端到端黑盒,失败了说不清是模型蠢还是电机抖。HumanCLAW 的 trick 在于用真人身体当"完美执行器"——人自己平衡、自己补偿扰动,VLM 只负责发技能指令。这比在仿真里测更真实,比上真机器人更可控。

这个思路可以迁移:如果你在做机械臂或人形机器人,先用 HumanCLAW 类似的方法筛一遍 VLM 的决策能力,再上硬件调控制,能省大量迭代时间。论文提到会开源,但代码还没放,建议先 mark 住等 release。

查看原文 →