Synthesis of Model Predictive Control and Reinforcement Learning: Survey and Classification

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本文研究了模型预测控制(MPC)与强化学习(RL)的关系,探讨其在马尔可夫决策过程中的应用与优势。提出了一种基于演员-评论家方法的分类框架,并展示了如何利用MPC的在线优化提升政策性能。

🏷️

标签

➡️

继续阅读