该文介绍了一种新的无监督技能发现算法DISCO-DANCE,它通过选择具有未探索状态潜力最高的引导技能,引导其他技能跟随引导技能,然后引导的技能在未探索的状态下分散以最大化它们的可区分性,以增强探索能力。
完成下面两步后,将自动完成登录并继续当前操作。