差分隐私模型导向的离线强化学习

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

该文章介绍了一种使用差分隐私保证的离线增强学习方法,从离线数据中学习环境的私有模型,并推导出一个策略,实现了训练私有的增强学习智能体的目标。

🏷️

标签

➡️

继续阅读