$H^3$ Fusion: Helpful, Harmless, and Honest Fusion of Aligned LLMs

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了$H^3$融合方法,旨在提升对齐模型在生成有益、无害和诚实回答方面的性能。通过集成多个对齐的LLM并动态选择模型输出,性能和鲁棒性显著提高,提升幅度达11.37%。

🏷️

标签

➡️

继续阅读