首页 /研究 /面向通信丢失下鲁棒多智能体协调的价值感知预测
LEARNING

面向通信丢失下鲁棒多智能体协调的价值感知预测

Kemal Devrim Kafadar, Eren Özaltun, Mahmud Efnan Şanlı, Feyza Orak, Emirhan Gazi, Kubilay Kağan Kömürcü, Nazım Kemal Üre

发表年份
2026
访问权限
开放获取

摘要

本文提出了一种价值感知的多智能体观测共享方法(Value-Aware MARO),通过利用优势估计动态加权预测器损失函数,使预测学习过程与策略演化耦合。该方法在通信中断时优先学习高回报的决策相关动态,提升了多智能体系统的鲁棒性。

关键词

multi-agent coordinationcommunication lossreinforcement learningvalue-aware predictionactor-critic

相关论文

查看 LEARNING 分类全部论文