论文记录 · 证据边界公开

HumanCLAW: Can Vision-Language Models Act Through a Body?

arXiv v2 (cs.CV/cs.RO;项目页/代码/权重/数据集齐备) · 2026-07-29 · 视觉识别

论文元数据

作者
Li Siyao、Jiawei Gu、Shuai Liu、Kairui Hu、Zekun Li、Linjie Li、Chengcheng Tang、Po-Chen Wu、Ivan Shugurov、Lingni Ma、Michael Zollhoefer、Sizhe An、Abhay Mittal、Amy Zhao、Ranjay Krishna、Manling Li、Ziwei Liu、Chuan Guo
机构
机构尚未补齐
发布日期精度
研究方向
视觉识别
机器人
无物理本体(AI Habitat+Bullet 全身人形仿真 HumanCLAW-Bench;含 HSSD 室内场景)
DOI
未披露
arXiv
2607.27180
引用元数据
0
记录状态
included
质量检查
无自动质量红旗