首页 /研究 /DiMaS:面向视觉-语言-动作模型的分布匹配引导策略
MANIPULATION

DiMaS:面向视觉-语言-动作模型的分布匹配引导策略

Pegah Khayatan, Sara Meziane, Jayneel Parekh, Matthieu Cord

发表年份
2026
访问权限
开放获取

摘要

本文提出DiMaS,一种针对流匹配视觉-语言-动作模型的分布匹配引导策略,通过传输表示分布而非沿固定方向移动,有效控制机器人操作行为。实验表明,该方法在两种先进VLA模型上均优于经典线性引导方法,并分析了行为特征在视觉运动设置中的表示结构。

关键词

vision-language-actiondistribution matchingbehavioral controlflow matchingrepresentation steering

相关论文

查看 MANIPULATION 分类全部论文