道德不是二元的:使用对比学习来构建多元化的道德句子嵌入空间

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

研究发现,Chat-GPT语言模型的神经活动拓扑结构对公平性的度量标准有影响。GPT-3.5的句子嵌入可以分解为公平和不公平道德判断对应的两个子流形,表明GPT在训练过程中对公平性有了理解。

🏷️

标签

➡️

继续阅读