首页 /研究 /泛化与引导:分解奖励实现少样本逆强化学习
LEARNING

泛化与引导:分解奖励实现少样本逆强化学习

Ziyi Liu, Grace Zhang

发表年份
2026
访问权限
开放获取

摘要

本文提出多任务判别器邻近引导逆强化学习(MPG),通过分解奖励为可泛化判别器和邻近函数两部分,解决少样本逆强化学习中的任务变化问题。该方法利用相关任务演示和在线经验,从有限目标演示中有效学习新任务。

关键词

inverse reinforcement learningfew-shot learningmulti-task learningreward decompositionimitation learning

相关论文

查看 LEARNING 分类全部论文