论文记录 · 证据边界公开

Causal Reward World Models: Zero-shot Reward Design for Automated Skill Generation

arXiv technical report · 2026-06-22 · 世界模型与动作条件预测

论文元数据

作者
Yang Yang、Yuchuang Tong、Zhengtao Zhang、Xu Ding、Ning Yang、Yifan Zhang、Haipeng Li、Kehu Yang、Miao Xin
机构
机构尚未补齐
发布日期精度
研究方向
世界模型与动作条件预测
机器人
CASBOT W1 mobile manipulator、ManiSkill2 single-arm robots、simulated Shadow Hand
DOI
未披露
arXiv
2606.23280
引用元数据
0
记录状态
included
质量检查
无自动质量红旗

算力与训练档案 置信 low · 模型 glm-5.3 · 更新 2026-09-02T07:59:50Z

本体标签: CASBOT W1 mobile manipulator, ManiSkill2 single-arm robots, simulated Shadow Hand

技术标签: 世界模型与动作条件预测, 因果世界模型, 自动奖励设计, 零样本技能生成, 灵巧操作, 跨本体迁移, 强化学习

训练算力(显卡)未披露
训练时长未披露
部署推理硬件未披露
显存/内存/CPU 占用未披露
运行效率(Hz)未披露

证据材料里未披露这些数值 —— 宁缺勿假, 不填推测值。