离线强化学习中的等变数据增强技术

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

该文介绍了一种离线强化学习方法,利用先前的经验来学习政策,以解决分布偏移和有效表示策略的问题。该方法将状态重构特征学习纳入扩散策略中,以解决分布外泛化问题。作者在多个任务上评估了该模型的性能,实现了最先进的结果。

🏷️

标签

➡️

继续阅读