论文记录 · 证据边界公开

Masked Visual Actions for Unified World Modeling

arXiv technical report · 2026-07-21 · 世界模型与动作条件预测

论文元数据

作者
Hadi Alzayer、Wenlong Huang、Haonan Chen、Christopher Luey、Lvmin Zhang、Maneesh Agrawala、Gordon Wetzstein、Li Fei-Fei、Yilun Du、Jiajun Wu、Jia-Bin Huang
机构
机构尚未补齐
发布日期精度
研究方向
世界模型与动作条件预测
机器人
BEHAVIOR R1 Pro、DROID Franka robots、Franka Emika Panda、RoboCasa simulated robot
DOI
未披露
arXiv
2607.19343
引用元数据
0
记录状态
included
质量检查
无自动质量红旗

算力与训练档案 置信 low · 模型 glm-5.3 · 更新 2026-09-02T05:18:51Z

本体标签: BEHAVIOR R1 Pro, DROID Franka robots, Franka Emika Panda, RoboCasa simulated robot

技术标签: 世界模型与动作条件预测, 世界模型, 动作条件视频生成, 跨本体泛化, 模型规划, 逆动力学, 机器人数据

训练算力(显卡)未披露
训练时长未披露
部署推理硬件CUDA GPU
显存/内存/CPU 占用未披露
运行效率(Hz)未披露

证据原文: