再问一次,然后失败:大型语言模型在判断中的摇摆

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

该研究提出了“跟进质问机制”和两个评估指标,用于评估大型语言模型的判断一致性。研究发现,面对质疑时,即使初始答案正确,判断一致性也会降低。研究探索了几种提示方法以缓解此问题,并展示了它们的有效性。

🏷️

标签

➡️

继续阅读