大型语言模型在道德场景中一致性不足。研究提出语义图熵等度量,通过经验法则提升与人类判断的相关性;调查显示模型在明确道德情境多与常识一致,模糊情境则常表不确定且易受提问方式影响。另有研究用多阶段框架提升问答可靠性,并提出假设与组合一致性等概念,发现模型面对质疑时判断一致性显著下降。
完成下面两步后,将自动完成登录并继续当前操作。