小红花·文摘

本研究提出了一种名为ARCHIE的自主强化学习方法，利用GPT-4从自然语言任务描述生成奖励函数，解决复杂人机协作中的奖励函数设计难题。实验结果表明，该方法能够有效将人类可读文本转化为可部署的机器人技能。