SyncTalk: 谈话头部合成中的关键:同步问题

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

本文介绍了一种利用深度生成模型和语音输入信号为静止面部图像添加动画的方法,通过多尺度音频视觉同步损失和多尺度自回归生成对抗网络,提高了头部动作质量和多尺度音频视觉同步。

🏷️

标签

➡️

继续阅读