SpiRit-LM: 交叉融合的口语和书面语言模型

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

SPIRIT-LM是一个混合文本与语音的多模态语言模型,通过在文本和语音单元上进行连续训练来实现。它展示了文本模型的语义能力和语音模型的表达能力,并能够跨多模态学习新任务。

🏷️

标签

➡️

继续阅读