论文记录 · 证据边界公开

CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models

IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2025) · 2025-03-27 · 通用或轻量 VLA

论文元数据

作者
Qingqing Zhao、Yao Lu、Moo Jin Kim、Zipeng Fu、Zhuoyang Zhang、Yecheng Wu、Zhaoshuo Li、Qianli Ma、Song Han、Chelsea Finn、Ankur Handa、Tsung-Yi Lin、Gordon Wetzstein、Ming-Yu Liu、Donglai Xiang
机构
NVIDIA、Massachusetts Institute of Technology、Stanford University
发布日期精度
研究方向
通用或轻量 VLA
机器人
未关联具体机器人
DOI
10.1109/CVPR52734.2025.00166
arXiv
2503.22020
arXiv 当前版本
1
arXiv 最近修订
2025-03-27
arXiv 主分类
cs.RO
引用元数据
31
记录状态
included
质量检查
无自动质量红旗