论文记录 · 证据边界公开

MuseVLA: An Adaptive Multimodal Sensing Vision-Language-Action Model for Robotic Manipulation

arXiv preprint · 2026-06-16 · 通用或轻量 VLA

论文元数据

作者
Xingyuming Liu、Ruichun Ma、Heyu Guo、Qixiu Li、Qingwen Yang、Lin Luo、Shiqi Jiang、Chenren Xu、Jiaolong Yang、Baining Guo
机构
Peking University、Microsoft Research Asia、Princeton University、Tsinghua University
发布日期精度
研究方向
通用或轻量 VLA
机器人
Calterah 4T4R 60GHz mmWave radar、Intel RealSense RGB-D、Robotera XHand 12-DoF dexterous hand、Sipeed 6+1Mic Array、infiRay T2S thermal cameras、table-top robot with Robotera XHand 12-DoF dexterous hand、tabletop robot arm platform
DOI
10.48550/arXiv.2606.17598
arXiv
2606.17598
引用元数据
0
记录状态
included
质量检查
无自动质量红旗