Can Large Language Models Provide Counterfactual Self-Explanations?

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究探讨大型语言模型(LLM)在生成反事实自我解释方面的不足,发现其在生成这些解释时常遇到困难,且预测结果与反事实推理不一致。这对提升模型自我解释能力具有重要意义。

🏷️

标签

➡️

继续阅读