本文介绍了一种通用的离线学习方法,通过考虑输入特征的计算成本,并将成本约束纳入到决策变换器的扩展中,从而在推断过程中限制其成本,使模型能够在每个时间步动态选择最佳输入特征。通过实验验证了该方法的有效性,并表明相比传统方法,它能够在使用较少计算资源的情况下实现类似的性能。
正在访问的资源需要验证您是否真人。
或在微信中搜索公众号“小红花技术领袖”并关注
第二步:在公众号对话中发送验证码: