研究人员提出了一种递归视觉解释算法(ReVisE),用于有限注释的视觉推理任务。该算法通过逐步计算视觉特征、答案和解释来提高解释质量。在VCR和VQA-X数据集上,该方法仅利用人类注释的5%的数据,却在几项指标上超过以往方法,BLEU-1得分分别提高了4.2和1.3。
完成下面两步后,将自动完成登录并继续当前操作。