QUENCH: Measuring the Gap in Contextual Reasoning between Indian and Non-Indian Contexts in Large Language Models

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出QUENCH,一种基于文本的英语测验基准,旨在评估大型语言模型的世界知识和推理能力,结合地理背景与常识推理,以加深对LLMs缺陷的理解。

🏷️

标签

➡️

继续阅读