Fg-T2M:基于扩散模型的精细文本驱动人体运动生成

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

本文介绍了一种基于 Transformer 的 VQ-VAE 的优先级中心的 M2DM 模型,用于逆扩散过程中的动作表示。该模型在保真度和多样性方面超过了现有技术,尤其对于复杂的文本描述。

🏷️

标签

➡️

继续阅读