软件定义网络中的对抗深度强化学习在网络安全中的应用

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

本文介绍了针对强化学习的对抗攻击,提高了深度强化学习算法对参数不确定性的鲁棒性。作者展示了简单的攻击可以降低算法性能,并使用梯度信息改进了攻击方法,进一步降低性能。这些攻击方法用于训练中,提高了RL控制框架的鲁棒性。作者在多个RL基准测试环境中展示了对抗训练可以显著提高DRL算法对参数变化的鲁棒性。

🏷️

标签

➡️

继续阅读