学习具有高成本特征的计算效率机器人

我们提出了一种通用的离线学习方法，其中考虑了输入特征的计算成本，通过将成本约束纳入到决策变换器的扩展中，从而在推断过程中限制其成本，使模型能够在每个时间步动态选择最佳输入特征。我们通过 D4RL 基准和类似于视频游戏中的复杂 3D 环境等多个任务展示了我们方法的有效性，并表明与传统方法相比，它能够在使用显著较少的计算资源的情况下实现类似的性能。

本文介绍了一种通用的离线学习方法，通过考虑输入特征的计算成本，并将成本约束纳入到决策变换器的扩展中，从而在推断过程中限制其成本，使模型能够在每个时间步动态选择最佳输入特征。通过实验验证了该方法的有效性，并表明相比传统方法，它能够在使用较少计算资源的情况下实现类似的性能。

决策变换器推断过程机器人离线学习方法计算成本输入特征