增强强化学习智能体与本地指导

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

该研究提出了一种用于强化学习智能体的安全行为的框架,通过专家策略的演示来优化智能体的行为。实验证明该算法在离散和连续问题中表现良好。

🏷️

标签

➡️

继续阅读