开放的配方:通过模型融合在一天内将语言特定的大型语言模型适应为推理模型

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

本研究提出了一种模型融合方法,显著提升了泰语大型语言模型的推理能力,达到DeepSeek R1水平。

🏷️

标签

➡️

继续阅读