使用监督学习构建短视多方计算策略

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

使用监督学习离线学习最优值函数的方法可以在近视型MPC中减少在线计算负担,而不影响控制器性能。该方法通过使用离线收集的状态-值对来学习代价函数,而不是闭环性能数据。

➡️

继续阅读