首页 /研究 /事件-VLA:基于动作条件的事件融合鲁棒视觉-语言-动作模型
MANIPULATION

事件-VLA:基于动作条件的事件融合鲁棒视觉-语言-动作模型

Jiaxin Liu, Xun Xu, Zhenhao Zhang, Hanqing Wang, Ruiqi Chen, Shi Chang, Weiyu Guo, Laurent Kneip

发表年份
2026
访问权限
开放获取

摘要

本文提出Event-VLA框架,通过引入事件流作为光照鲁棒的互补观测,增强视觉-语言-动作模型在光照变化下的鲁棒性。该框架采用动作查询路由机制,利用可学习动作查询从VLA推理中提取任务相关语义,并通过门控交叉注意力选择性聚合事件特征,从而构建事件感知的动作表征。

关键词

Event cameraVision-Language-ActionRobust manipulationIllumination robustnessMultimodal fusion

相关论文

查看 MANIPULATION 分类全部论文