Stronger Models Are Not Necessarily Better Teachers for Instruction Tuning

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究质疑了指令调优中“强模型是好教师”的假设,实验表明更强的模型并不总能有效指导小模型。提出的新度量“兼容性调整奖励(CAR)”表现优于现有基线。

🏷️

标签

➡️

继续阅读