论文记录 · 证据边界公开

Prism-GRPO: Faster VLA Policy Optimization via Splitting Same-outcome Groups

arXiv v1 (cs.RO/cs.LG) · 2026-08-18 · 通用或轻量 VLA

论文元数据

作者
Zeyun Deng、Yuzhe Lu、Yawei Wang、Linbo Liu、Qing Ping、Han Ding、Guande Wu、Panpan Xu、Jun Huan
机构
Purdue University、AWS AI、UCLA Mobility Lab access
发布日期精度
研究方向
通用或轻量 VLA
机器人
ALOHA in RoboTwin 2.0、Piper real robot
DOI
10.48550/arXiv.2608.17423
arXiv
2608.17423
引用元数据
0
记录状态
included
质量检查
无自动质量红旗