论文记录 · 证据边界公开

FoMoVLA: Bridging Visual Foresight and Motion Guidance for Vision-Language-Action Models

arXiv · 2026-07-16 · 通用或轻量 VLA

论文元数据

作者
Wei Li、Peijin Jia、Yuan Ma、Xuefeng Jiang、Titong Jiang、Sheng Sun、Yujian Li、Xin Wen、Han Hong、Zhikang Liu、Bailin Li、Kun Zhan
机构
Li Auto、University of Chinese Academy of Sciences、Tsinghua University
发布日期精度
研究方向
通用或轻量 VLA
机器人
未关联具体机器人
DOI
10.48550/arXiv.2607.14739
arXiv
2607.14739
引用元数据
0
记录状态
included
质量检查
无自动质量红旗

算力与训练档案 置信 low · 模型 glm-5.3 · 更新 2026-09-03T06:06:12Z

技术标签: 通用或轻量 VLA, VLA, 视觉前瞻, 点跟踪, 世界模型监督, 低部署增量

训练算力(显卡)未披露
训练时长未披露
部署推理硬件未披露
显存/内存/CPU 占用未披露
运行效率(Hz)未披露

证据材料里未披露这些数值 —— 宁缺勿假, 不填推测值。