大型语言模型(LLM)在应用中取得成功,但虚假生成问题限制了其发展。研究综述了虚假生成的检测与减轻方法,提出了一种无参考的基于不确定性的检测方法,评估了幻觉表现,并引入了新基准和框架以提高检测有效性。通过多种模型和数据集,研究显示有效降低了幻觉比例,并在相关任务中取得了良好的准确率。
完成下面两步后,将自动完成登录并继续当前操作。