Regret-Free Exploration in Shuffled Privacy Reinforcement Learning

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

该研究提出了一种新信任模型,旨在改善差分隐私强化学习中的用户数据隐私保护,开发了针对洗牌模型的算法,实验结果显示其隐私成本优于传统模型。

🏷️

标签

➡️

继续阅读