小红花·文摘

该文章介绍了一种离线强化学习方法，利用先前经验学习更好的政策。该方法适用于非专家数据和多模态行为策略。作者提出了一种新方法，将状态重构特征学习纳入扩散策略中，以解决分布外泛化问题。在多模态环境和几个基准任务上评估了该模型的性能，取得了最先进的结果。