论文记录 · 证据边界公开

Reducing Temporal Redundancy for Efficient Vision-Language-Action Inference

arXiv · 2026-07-14 · 通用或轻量 VLA

论文元数据

作者
Yuzhou Wu、Yuxin Zheng、Muchun Niu、Yishan Yang、Tianhao Liu、Hanwen Kang、Jiajian Jing、Linfeng Zhang、Chuan Wen
机构
Tianji KernalMind Co., Ltd.、Tsinghua Shenzhen International Graduate School、Shanghai Jiao Tong University、Southeast University、Huazhong Agricultural University
发布日期精度
研究方向
通用或轻量 VLA
机器人
未关联具体机器人
DOI
未披露
arXiv
2607.12287
引用元数据
0
记录状态
included
质量检查
无自动质量红旗

算力与训练档案 置信 low · 模型 glm-5.3 · 更新 2026-09-01T09:45:51Z

技术标签: 通用或轻量 VLA, VLA, 低时延推理, 视觉 token 复用, flow matching, 动作头压缩, 低算力高性能, 实体操作

训练算力(显卡)未披露
训练时长未披露
部署推理硬件NVIDIA RTX 4090
显存/内存/CPU 占用未披露
运行效率(Hz)未披露

证据原文: