仅使用清晰语音的自监督语音质量估计和增强

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

该论文介绍了一种针对语音识别的自监督学习方法,通过使用随机投影量化器生成离散标签,从而学习模型预测被屏蔽掉的语音信号。实验结果表明,该方法在多语种任务中比旧有的模型具有更低的字错率和延迟。

🏷️

标签

➡️

继续阅读