公平合作的车辆路径规划:深度多智能体强化学习方法

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

本文提出了一个使用强化学习解决车辆路径问题的端到端框架,通过策略梯度算法优化参数,实时生成解决方案,解决负载容量 VRP 的中等规模实例时,在解决质量上优于经典的启发式算法和 Google 的 OR-Tools,同时具有可比较的计算时间。

🏷️

标签

➡️

继续阅读