论文记录 · 证据边界公开

Repetition as Reinforcement: Enhancing Sample Efficiency via Instant Episode Repetition in Reinforcement Learning

arXiv(v1 2026-08-18;cs.LG 主分类;comments:RLC 2026 录用,RLJ 2026;无撤稿标记) · 2026-08-18 · 交互期即时 episode 重放(IER)vs 被动 replay/SIL 类方法;MuJoCo+DMC+真实机械手 in-hand 任务

论文元数据

作者
Hoda Yamani、Yuning Xing、Koen van Rijnsoever、Bruce A. MacDonald、Henry Williams
机构
机构尚未补齐
发布日期精度
研究方向
交互期即时 episode 重放(IER)vs 被动 replay/SIL 类方法;MuJoCo+DMC+真实机械手 in-hand 任务
机器人
MuJoCo / DeepMind Control Suite(连续控制基准)、真实机械手(Dynamixel 伺服夹爪,in-hand 物体平移)
DOI
未披露
arXiv
2608.17347
引用元数据
0
记录状态
included
质量检查
无自动质量红旗