Look Where It Matters: Adaptive Visual Refinement for Vision-Language-Action Models
arXiv preprint · 2026-08-03 · 通用或轻量 VLA
论文元数据
作者
Jin Cui、Yanbin Hu、Xinyue Long、Linkai Li、Boran Zhao、Pengju Ren
机构
Xi'an Jiaotong University State Key Laboratory of Human-Machine Hybrid Augmented Intelligence、Xi'an Jiaotong University Institute of Artificial Intelligence and Robotics、Xi'an Jiaotong University School of Software Engineering
发布日期精度
日
研究方向
通用或轻量 VLA
机器人
Franka Research 3、Intel RealSense D435i、NVIDIA RTX 4090