本文综述利用大语言模型进行数据增强以提升跨语言常识推理、医学问答和低资源阅读理解等任务性能的研究。GPT-4生成数据效果最佳,CultureLLM等方法显著优于对比模型,但模型在抽取式问答和证据检索方面仍存挑战,需更全面评估框架。
完成下面两步后,将自动完成登录并继续当前操作。