DiffusionGPT: 基于 LLM 的文本到图像生成系统

💡 原文中文,约500字,阅读约需2分钟。
📝

内容提要

本研究通过与最新的DALLE3集成的T2I模型ChatGPT,重新审视现有的T2I系统,并引入了交互式文本到图像(iT2I)任务。通过引入提示技术和现成的T2I模型,提出了一种简单的方法来增强LLMs在iT2I上的能力。希望本研究能够提升人机交互的用户体验和下一代T2I系统的图像质量。

🏷️

标签

➡️

继续阅读