论文记录 · 证据边界公开

Learning More from Less: Reinforcement Learning from Hindsight

arXiv technical report · 2026-07-10 · 通用或轻量 VLA

论文元数据

作者
Iris Xu、Sunshine Jiang、John Marangola、Nitish Dashora、Richard Li、Thomas Liu、Zexue He、Yuheng Zhi、Alex Pentland、Pulkit Agrawal、Zhang-Wei Hong
机构
Massachusetts Institute of Technology、MIT-IBM Watson AI Lab、Stanford University、University of California, San Diego
发布日期精度
研究方向
通用或轻量 VLA
机器人
Franka FR3、GR00T、LIBERO-PRO simulation、OpenVLA-OFT、pi0.5
DOI
未披露
arXiv
2607.09042
引用元数据
0
记录状态
included
质量检查
无自动质量红旗