论文记录 · 证据边界公开

Teaching Vision-Language-Action Models What to See and Where to Look

arXiv (ECCV 2026 accepted; v1 2026-07-02) · 2026-07-02 · 通用或轻量 VLA

论文元数据

作者
Yuguang Yang、Canyu Chen、Zhewen Tan、Yizhi Wang、Zichao Feng、Chunyang Liu、Kehua Sheng、Juan Zhang、Linlin Yang、Baochang Zhang、Yan Wang、Bo Zhang、Xianbin Cao
机构
机构尚未补齐
发布日期精度
研究方向
通用或轻量 VLA
机器人
无物理机器人;NAVSIM/nuScenes 自动驾驶仿真基准(驾驶体语境)
DOI
未披露
arXiv
2607.01658
引用元数据
0
记录状态
included
质量检查
无自动质量红旗