论文记录 · 证据边界公开

DriveTok: 3D Driving Scene Tokenization for Unified Multi-View Reconstruction and Understanding

arXiv v1 · 2026-03-19 · 3D 场景分词器(DriveTok)vs 单目/2D tokenizer(多摄一致性与统一重建/理解)

论文元数据

作者
Dong Zhuo、Wenzhao Zheng、Sicheng Zuo、Siming Yan、Lu Hou、Jie Zhou、Jiwen Lu
机构
机构尚未补齐
发布日期精度
研究方向
3D 场景分词器(DriveTok)vs 单目/2D tokenizer(多摄一致性与统一重建/理解)
机器人
无机器人本体(nuScenes 数据集多任务评测)
DOI
未披露
arXiv
2603.19219
引用元数据
0
记录状态
included
质量检查
无自动质量红旗