论文记录 · 证据边界公开

ExToken: Structured Exploration for Efficient Vision-Language-Action Reinforcement Fine-tuning

arXiv · 2026-07-14 · 通用或轻量 VLA

论文元数据

作者
Yilun Kong、Yunpeng Qing、Guozheng Ma、Haoyu Wang、Li Shen、Zhi Hou、Dacheng Tao
机构
Nanyang Technological University、ACE Robotics、Zhejiang University、Sun Yat-sen University
发布日期精度
研究方向
通用或轻量 VLA
机器人
未关联具体机器人
DOI
未披露
arXiv
2607.12931
引用元数据
0
记录状态
included
质量检查
无自动质量红旗

算力与训练档案 置信 medium · 模型 glm-5.3 · 更新 2026-09-01T16:39:24Z

技术标签: 通用或轻量 VLA, VLA, 强化学习, 结构化探索, 行为 token, 样本效率, HIL, OOD 泛化

训练算力(显卡)8×A800
训练时长未披露
部署推理硬件single A800
显存/内存/CPU 占用未披露
运行效率(Hz)未披露

证据原文: