首页 /研究 /VLN-AVP:基于混合长短时记忆的零样本视觉语言导航自主代客泊车
LOCOMOTION

VLN-AVP:基于混合长短时记忆的零样本视觉语言导航自主代客泊车

Yijian Li, Xiangru Mu, Changze Li, Hantian Shi, Jiyuan Cai, Jia Cai, Xiaoxue Liu, Yajing Sun, Ming Yang, Tong Qin

发表年份
2026
访问权限
开放获取

摘要

本文提出VLN-AVP框架,通过结合鸟瞰图模型的精确空间感知与视觉语言模型的通用智能,实现了无需预建地图的零样本自主代客泊车导航。该框架引入混合记忆系统,包括短期感知记忆和长期拓扑记忆,以增强语义理解与策略学习,并提供了包含10个高保真停车场景和1000多个导航情节的新基准数据集。

关键词

zero-shot navigationvision-language navigationautonomous valet parkinghybrid memorybird's-eye-view

相关论文

查看 LOCOMOTION 分类全部论文