PuzzleBench: LLM 能解决挑战性的一阶组合推理问题吗?

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

大型语言模型(LLMs)在解决经典演绎推理问题方面能力有限,改变展示格式和内容也不能提高性能。研究发现LLMs具有独特的推理偏见,只能部分预测人类的推理表现。

🏷️

标签

➡️

继续阅读