首页 /研究 /基于系统化多智能体深度强化学习的复杂环境多无人机协同导航
SWARM

基于系统化多智能体深度强化学习的复杂环境多无人机协同导航

Yu Su, Nabil Aouf

发表年份
2026
访问权限
开放获取

摘要

本文提出了一种多智能体深度强化学习框架,通过协调探索、示范利用、安全课程调度和结构感知泛化,解决了多无人机在复杂环境中协同导航面临的局部最优陷阱、稀疏奖励、学习不平衡和跨场景泛化不足等关键挑战。该方法结合记忆感知、方向新颖性估计和惩罚反向传播机制,使智能体能够主动检测并逃离局部最优,同时利用分层协作示范缓冲区和安全感知课程调度机制提升学习效率和飞行安全性。

关键词

multi-agentdeep reinforcement learningUAV navigationcooperative explorationcurriculum learning

相关论文

查看 SWARM 分类全部论文