Reinforcement Learning in Unknown Environments through Language-Guided Composable Causal Component Modeling

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了一种新颖的世界建模框架WM3C,旨在解决强化学习中智能体在未知动态环境下的泛化问题。实验结果表明,WM3C在适应新任务、识别潜在过程和改进策略学习方面显著优于现有方法。

🏷️

标签

➡️

继续阅读