耶鲁等机构研究发现,大模型内部向量可被“张量积表示”的符号公式高度近似替换,且模型功能不变,干预实验成功率达90.3%。这支持了符号结构涌现理论,但存在2.36%的差距,表明近似而非等同,复杂句处理更依赖词序。
该论文研究了LLMs对内部记忆或给定提示的偏好鲁棒性,发现这些模型对误导性提示非常敏感。通过干预实验,揭示了它们的鲁棒性和适应性的上限差异。
完成下面两步后,将自动完成登录并继续当前操作。