小红花·文摘

本研究比较了单目标和多目标强化学习方法，针对机器人导航问题进行了探究。通过修改奖励函数，机器人学习了平衡不同目标的策略。研究显示多目标强化学习在机器人导航任务中具有潜力，为进一步研究机器人行为奠定了基础。

BriefGPT - AI 论文速递 ·

本研究比较了单目标和多目标强化学习方法，针对机器人导航问题进行了探究。通过修改奖励函数，机器人学习了平衡不同目标的策略。研究表明，多目标强化学习在机器人导航任务中具有潜力，为进一步研究机器人行为奠定了基础。

BriefGPT - AI 论文速递 ·