论文记录 · 证据边界公开

SoftNav: Injecting 3D Scene Tokens into VLMs for Embodied Navigation

arXiv · 2026-07-16 · 空间感知与导航

论文元数据

作者
Yi Wu、Junjie An、Xiao Liu、Yiqun Zhou、Yuechen Wu、Xiaoqing Guan、Shuyang Yu、You Wang、Guang Li
机构
Zhejiang University、Shandong University
发布日期精度
研究方向
空间感知与导航
机器人
未关联具体机器人
DOI
10.48550/arXiv.2607.14586
arXiv
2607.14586
引用元数据
0
记录状态
included
质量检查
无自动质量红旗

算力与训练档案 置信 low · 模型 glm-5.3 · 更新 2026-09-01T21:49:06Z

技术标签: 空间感知与导航, 开放词汇导航, 3D场景理解, 软token, 低样本训练, Zero-shot

训练算力(显卡)未披露
训练时长未披露
部署推理硬件offboard GPU computer
显存/内存/CPU 占用未披露
运行效率(Hz)未披露

证据原文: