SiFiSinger: A High-Fidelity End-to-End Singing Voice Synthesizer Based on Source-Filter Model

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了一种基于源-滤波机制的高保真端到端歌声合成系统,旨在解决音调预测错误问题。通过解耦梅尔谱特征与基频信息,并引入源激励信号,该系统在合成质量和音调准确性上有显著提升。

🎯

关键要点

  • 本研究提出了一种基于源-滤波机制的高保真端到端歌声合成系统。
  • 该系统旨在解决现有歌声合成系统中的音调预测错误问题。
  • 通过解耦梅尔谱特征与基频信息,系统能够更准确地捕捉音调细微变化。
  • 引入源激励信号显著提升了合成质量和音调准确性。
  • 实验结果表明,该系统在合成质量和音调准确性上具有显著提升潜力。
➡️

继续阅读