首页 /研究 /视觉-语言-运动地图:面向3D场景地图的开放词汇、不确定性感知、可查询运动属性
PERCEPTION

视觉-语言-运动地图:面向3D场景地图的开放词汇、不确定性感知、可查询运动属性

Dibyendu Ghosh, Ayushi Shakya

发表年份
2026
引用次数
0
访问权限
开放获取

摘要

本文提出视觉-语言-运动地图(VLMM),为3D场景地图中的每个元素赋予融合了语义先验与几何观测的运动属性及不确定性,支持自然语言查询。实验表明,该方法在动态场景中能有效区分已运动、可运动但未动及静止元素,且不确定性通道显著提升了运动检测的准确率。

关键词

open-vocabulary3D scene mappingmotion attributeuncertainty-awarevision-language-motion

相关论文

查看 PERCEPTION 分类全部论文