AI绘画能力的起源:从VAE、扩散模型DDPM、DETR到ViT/Swin transformer

💡 原文中文,约4500字,阅读约需11分钟。
📝

内容提要

本文介绍了CV领域的典型视觉模型,包括R-CNN、YOLO、DETR等,并重点介绍了从VE、VAE到Diffusion Model的模型原理。VAE通过添加高斯噪声和让所有趋近于标准正态分布来保证模型有噪声和随机性。而DM则是一种新的生成模型,可以用于图像生成和插值。

🏷️

标签

➡️

继续阅读