PERCEPTION
视觉-语言-运动地图:面向3D场景地图的开放词汇、不确定性感知、可查询运动属性
Dibyendu Ghosh, Ayushi Shakya
- 发表年份
- 2026
- 引用次数
- 0
- 访问权限
- 开放获取
摘要
本文提出视觉-语言-运动地图(VLMM),为3D场景地图中的每个元素赋予融合了语义先验与几何观测的运动属性及不确定性,支持自然语言查询。实验表明,该方法在动态场景中能有效区分已运动、可运动但未动及静止元素,且不确定性通道显著提升了运动检测的准确率。
关键词
open-vocabulary3D scene mappingmotion attributeuncertainty-awarevision-language-motion
相关论文
PERCEPTION
📊 22,245 引用
Artificial intelligence: a modern approach
1995
PERCEPTION
📊 14,348 引用
Are we ready for autonomous driving? The KITTI vision benchmark suite
Andreas Geiger, P Lenz, R. Urtasun
2012
PERCEPTION
开放获取📊 9,777 引用
TensorFlow: Large-Scale Machine Learning on Heterogeneous Distributed Systems
Martı́n Abadi, Ashish Agarwal, Paul Barham 等 20 位作者
2016
PERCEPTION
📊 9,681 引用
Vision meets robotics: The KITTI dataset
Andreas Geiger, Philip Lenz, Christoph Stiller 等 4 位作者
2013