SWARM
基于系统化多智能体深度强化学习的复杂环境多无人机协同导航
Yu Su, Nabil Aouf
- 发表年份
- 2026
- 访问权限
- 开放获取
摘要
本文提出了一种多智能体深度强化学习框架,通过协调探索、示范利用、安全课程调度和结构感知泛化,解决了多无人机在复杂环境中协同导航面临的局部最优陷阱、稀疏奖励、学习不平衡和跨场景泛化不足等关键挑战。该方法结合记忆感知、方向新颖性估计和惩罚反向传播机制,使智能体能够主动检测并逃离局部最优,同时利用分层协作示范缓冲区和安全感知课程调度机制提升学习效率和飞行安全性。
关键词
multi-agentdeep reinforcement learningUAV navigationcooperative explorationcurriculum learning
相关论文
SWARM
📊 14,853 引用
A new optimizer using particle swarm theory
R.C. Eberhart, James Kennedy
2002
SWARM
📊 6,404 引用
Swarm Intelligence
Eric Bonabeau, Marco Dorigo, Guy Théraulaz
1999
SWARM
📊 3,446 引用
Design and use paradigms for gazebo, an open-source multi-robot simulator
Nathan Koenig, A. Howard
2005
SWARM
📊 1,708 引用
Swarm robotics: a review from the swarm engineering perspective
Manuele Brambilla, Eliseo Ferrante, Mauro Birattari 等 4 位作者
2013