针对空间控制文本到图像生成的遮蔽注意力扩散引导

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

本文介绍了一种名为ZestGuide的方法,通过结合自然语言界面和空间控制,解决了与图像画布上特定位置对象相关的文本生成图像的问题。实验结果表明,ZestGuide在精准对齐输入分割的情况下,提高了图像质量,并且在COCO数据集上的表现优于Paint with Words。

🏷️

标签

➡️

继续阅读