Metis: A Fundamental Speech Generation Model with Masked Generation Pre-training

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出Metis模型,通过300K小时的多样语音数据进行预训练和微调,克服现有模型的局限,实现多种语音生成任务的高效适应与优异表现。

🏷️

标签

➡️

继续阅读