HypRL: 强化学习用于超属性的控制策略

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了一种新方法,通过Skolem化处理超属性中的量词交替,利用强化学习算法学习复杂任务的最优控制策略,以满足多代理系统的安全性和公平性要求。

🏷️

标签

➡️

继续阅读