首页 /研究 /TAP-VLA:用于视觉语言动作模型的触觉注释提示
MANIPULATION

TAP-VLA:用于视觉语言动作模型的触觉注释提示

Mark Van der Merwe, Mohamad Louai Shehab, Jayjun Lee, Youngsun Wi, Yinpei Dai, Dmitry Berenson, Nima Fazeli

发表年份
2026
访问权限
开放获取

摘要

该论文提出TAP-VLA框架,通过将触觉传感器提取的剪切场叠加到多视图RGB图像上,以视觉增强方式为VLA模型提供触觉反馈,无需修改架构或额外预训练。该方法在接触丰富的操作任务中有效提升了VLA模型对接触力的感知能力,且计算开销极小。

关键词

tactile sensingvision-language-actioncontact-rich manipulationvisual augmentationshear field

相关论文

查看 MANIPULATION 分类全部论文