FADA: Fast Diffusion Avatar Synthesis with Mixed-Supervised Multi-CFG Distillation

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出FADA方法,解决音频驱动对话头像的慢推理速度问题。通过混合监督损失和多CFG蒸馏,FADA显著提高了模型的稳健性和推理速度,速度提升可达4.17-12.5倍,生成效果媲美最新扩散模型。

🏷️

标签

➡️

继续阅读