基于注意力动态图的复杂协调模型

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

本文提出了一种新的多智能体强化学习方法,利用智能体之间的DAG结构提高学习性能,并通过合成奖励的MARL模型证明其作为最优值函数的下限。实证测试表明该方法在四个DAG环境中优于其他非DAG方法。

🏷️

标签

➡️

继续阅读