论文记录 · 证据边界公开

Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning

arXiv preprint · 2026-08-13 · 通用或轻量 VLA

论文元数据

作者
Yao Zhou、Hang Gao、Fengge Wu、Changwen Zheng、Wenwen Qiang
机构
机构尚未补齐
发布日期精度
研究方向
通用或轻量 VLA
机器人
LIBERO simulated manipulation、RoboTwin 2.0 simulated bimanual manipulation embodiments
DOI
未披露
arXiv
2608.13026
引用元数据
0
记录状态
included
质量检查
无自动质量红旗