麻省理工等团队开发AI系统Ataraxos,在隐藏信息的棋盘游戏Stratego中大幅击败顶尖人类玩家。它结合自对弈强化学习与决策时规划,训练成本远低于DeepMind的DeepNash,并能推广至多款游戏,未来或助军事、商业谈判等现实决策。
DeepNash是一种人工智能,通过结合博弈论和无模型深度强化学习,从零开始掌握复杂棋盘游戏Stratego。它在自我对弈中达到人类专家水平,采用新算法成功实现纳什均衡,胜率高达97%。DeepNash的成功展示了在不确定环境中解决复杂问题的潜力,具有广泛应用前景。
Game-playing artificial intelligence (AI) systems have advanced to a new frontier.
完成下面两步后,将自动完成登录并继续当前操作。