论文记录 · 证据边界公开

Robo-Dopamine 2.0: History-Conditioned and OOD-Aware Process Reward Modeling for Robotic Manipulation

arXiv v1 (cs.RO) · 2026-08-16 · 通用或轻量 VLA

论文元数据

作者
Yijie Xu、Haopeng Jin、Run Zhou、Shengbang Liu、Sixiang Chen、Hongyang Cheng、Sicheng Hu、Peterson Co、Jinwen Luo、Huajie Tan、Shanghang Zhang
机构
Peking University、EvoPhys AI、Beijing University of Posts and Telecommunications、Tencent、Renmin University of China、Sun Yat-sen University
发布日期精度
研究方向
通用或轻量 VLA
机器人
RoboTwin 2.0 dual-arm simulation、dual Franka workcell
DOI
10.48550/arXiv.2608.15680
arXiv
2608.15680
引用元数据
0
记录状态
included
质量检查
无自动质量红旗