决策焦点学习的强化损失函数

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

研究在线凸优化游戏的最优策略的遗憾,证明了与随机进程设置中经验最小化算法的行为密切相关,具有自然的几何解释。对各种在线学习问题的最优策略给出了上下界限制,提供了对抗者的明确最优策略的下界。

🏷️

标签

➡️

继续阅读