论文记录 · 证据边界公开

Diffusion Timestep Modulated Reinforcement Learning

Robotics: Science and Systems 2026 (official project page) · 2026-05-12 · VLA后训练、在线强化学习探索与真实机器人少样本适应

论文元数据

作者
Matthew M. Hong、Jesse Zhang、Anusha Nagabandi、Abhishek Gupta
机构
University of Washington、Amazon Frontier AI and Robotics
发布日期精度
研究方向
VLA后训练、在线强化学习探索与真实机器人少样本适应
机器人
Franka、WidowX 250
DOI
10.48550/arXiv.2605.12236
arXiv
2605.12236
引用元数据
0
记录状态
included
质量检查
无自动质量红旗