小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI

LDM(潜在扩散模型)仍然是主流,但高倍压缩导致信息损失。新方法JiT直接预测原始数据,简化模型架构,提升高分辨率生成效果。尽管JiT未显著超越现有SOTA,但降低了计算成本,增强了模型的可迁移性和统一性。

生成扩散模型漫谈(三十一):预测数据而非噪声

科学空间|Scientific Spaces
科学空间|Scientific Spaces · 2025-11-24T09:31:00Z

本研究提出了一种基于强化学习的潜在扩散模型微调方法,克服了深度学习在复杂场景中的局限性,显著提升了超分辨率图像的质量。实验结果表明,在RESISC45数据集上取得了明显的改进。

ORL-LDM:离线强化学习指导的潜在扩散模型超分辨率重建

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2025-05-15T00:00:00Z

本研究改进了自回归模型用于图像生成,强调潜在空间的稳定性。通过引入高效的离散图像标记器,提升了图像生成能力,超越了LDM的表现。

稳定图像自回归建模的潜在空间:统一视角

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-10-16T00:00:00Z

通过利用潜在扩散模型的失真先验信息,提出了一种基于深度学习的遥感图像压缩方法,该方法利用生成的先验信息,通过增强网络实现对图像的质量提升。

LDM-RSIC: 探索远程感知图像压缩中的畸变先验与潜在扩散模型

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-06-06T00:00:00Z

基于车内外情景融合的动态风险评估方法,创建用于 ADAS 性能评估的多传感器数据集并融合车辆内外数据构建基于 LDM 的动态风险评估系统。

基于 LDM 系统的停车场场景动态风险评估方法

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-04-05T00:00:00Z

我们提出了一种称为文本引导对象生成(TOG)的新型图像编辑场景,即在实际图像中通过文本描述在空间上生成一个新的对象。我们的模型基于...

ST-LDM:现实图像中基于文本引导的物体生成的通用框架

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-03-15T00:00:00Z

AudioLM是一个高质量的音频生成框架,通过将输入音频映射为离散令牌序列,并在该表示空间中将音频生成视为一种语言建模任务。它通过混合标记方案实现了重建质量和长期结构两个目标,并通过大量的音频波形语料库进行了训练,可以生成自然、连贯的音频持续时间。

音频 LDM 2:使用自监督预训练学习整体音频生成

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2023-08-10T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码