本文使用对数极坐标图像数据和凝视控制来减少自主移动机器人上的图像处理时间的长期目标。使用深度强化学习方法和LSTM网络扩展了A3C深度强化学习方法,并训练出了三个Atari游戏的策略和凝视控制的策略。通过将图像像素数量减少5倍而不降低游戏性能,进一步降低了图像像素的数量。
完成下面两步后,将自动完成登录并继续当前操作。