工程资源状态 代码 未核验 权重 未核验 数据 未核验 许可证 未核验 当前实践优先级 高潜待持续验证 · 71/100 · 0–6 个月
路线标签: 安全VLA世界模型颠覆性分支
社区证据类型: 尚无独立社区验证
以交互世界模型给VLA提供安全强化学习环境,在SafeLIBERO和Franka五任务上同时评估任务与安全成功;32×A800和零工件使其暂非工程默认。
近期窗口 · 35/35发布距评分基准日 1 个月,落入 0–6 个月 窗口。 社区可复查验证 · 3/25仅论文证据,无项目页、工件或独立复现。 跨领域技术创新 · 20/20安全RL、交互世界模型、VLA和双成功指标统一。 量化实机证据 · 9/10Franka五任务、每方法任务10次,平均TSR 76%、SSR 70%。 开放与可复现 · 0/5无代码、权重或数据。 工程实用增量 · 4/5安全成功率口径有价值,但训练门槛极高。 社区可复查证据: 尚未收录;Stars、forks 与作者演示不计社区验证。
证据缺口: 缺少显式可复查社区复现/部署证据;开放与复现条件不足;无代码;无权重;无数据;32×A800;无独立复现
每日候选人工终审 SafeDojo让OpenVLA-OFT在交互视频世界模型中做安全GRPO:成功分类器与安全头按控制步评估想象轨迹,再用拉格朗日约束平衡任务收益和碰撞成本。SafeLIBERO Level-I安全成功率53.25、Level-II 49.62;Franka五任务每个方法-任务10次,SafeDojo平均TSR 76%、SSR 70%。它代表用世界模型替代危险真机探索的高收益路线,但完整优化使用32张A800-80GB,世界模型误差会随长时程积累,且没有项目页、代码、权重或SafeLIBERO数据开放。
实机证据: quantified_five_franka_tasks_ten_trials_each;Bowl-to-plate、Apple selection、Bread-to-toaster、Block stacking、Dual-arm stacking五任务;每个方法-任务10次,SafeDojo平均任务成功76%、同时安全成功70%。
硬件/本体: Franka Emika Panda single arm、dual-arm Franka、box obstacle
红旗与边界: 32×A800-80GB完整优化成本;无代码权重数据;world model长时预测误差累积;成功/安全分类器依赖训练分布;实机总量每方法50次但仅Franka体系;无独立复现
code · 状态 not_released · 许可证 not available未找到官方项目页或代码仓库。 weights · 状态 not_released · 许可证 not availableSafeDojo策略、world model、安全头和reward模型均未开放。 data · 状态 not_released · 许可证 not availableSafeLIBERO演示、rollout、安全标签和真实任务数据未开放。 原始来源