论文记录 · 证据边界公开

SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model

arXiv · 2026-06-15 · 世界模型与动作条件预测

论文元数据

作者
Kai Tang、Peidong Jia、Zhong Chu、Jixian Wu、Rui Ma、Jiajun Cao、Fangyuan Zhao、Sixiang Chen、Yichen Guo、Xiaowei Chi、Chun-Kai Fan、Kevin Zhang、Jinchang Xu、Fubing Yang、Weishi Mi、Xiaozhu Ju、Jian Tang、Shanghang Zhang
机构
Peking University、Beijing Innovation Center of Humanoid Robotics、Nanyang Technological University、The Hong Kong University of Science and Technology、University of Electronic Science and Technology of China
发布日期精度
研究方向
世界模型与动作条件预测
机器人
未关联具体机器人
DOI
10.48550/arXiv.2606.20698
arXiv
2606.20698
引用元数据
0
记录状态
included
质量检查
无自动质量红旗

算力与训练档案 置信 low · 模型 glm-5.3 · 更新 2026-09-02T09:25:04Z

技术标签: 世界模型与动作条件预测, VLA, 世界模型, 安全强化学习, 想象rollout, 约束优化, 实机操作

训练算力(显卡)未披露
训练时长未披露
部署推理硬件未披露
显存/内存/CPU 占用未披露
运行效率(Hz)未披露

证据材料里未披露这些数值 —— 宁缺勿假, 不填推测值。