小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI

该研究提出了一个统一的MoE公式,揭示了路由器在视觉MoE模型中的重要作用。

视觉多专家中的路由器:实证研究

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-01-29T00:00:00Z

研究人员提出了一个全面的数据集ChimpACT,用于量化黑猩猩的纵向行为和社会关系。该数据集包含163个视频,涵盖了2015年到2018年德国莱比锡动物园的20多只黑猩猩群体。实验结果表明,ChimpACT为解决黑猩猩群体的计算机视觉任务提供了机会,加深了对非人类灵长类动物的理解。

PanAf20K:野生猿类检测与行为识别的大型视频数据集

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-01-24T00:00:00Z

本研究提出了一项名为OpenVIS的新计算机视觉任务,旨在根据文本描述分割、检测和跟踪视频中的任意对象。通过开放词汇的设计,OpenVIS可以识别所需类别的对象,不受训练数据集的限制。研究提出了一个由两个阶段组成的流程,利用基于查询的蒙版提议网络生成潜在对象的蒙版,并通过预训练的VLM预测其类别,然后通过提议后处理方法更好地适应预训练的VLMs,以避免扭曲和不自然的提议输入。

基于布朗桥的开放词汇视频实例分割

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-01-18T00:00:00Z

本研究提出了一项名为OpenVIS的新计算机视觉任务,旨在根据文本描述分割、检测和跟踪视频中的任意对象。通过开放词汇的设计,OpenVIS可以识别所需类别的对象,不受训练数据集的限制。研究提出了一个由两个阶段组成的流程,利用基于查询的蒙版提议网络生成潜在对象的蒙版,并通过预训练的VLM预测其类别,然后通过提议后处理方法更好地适应预训练的VLMs,以避免扭曲和不自然的提议输入。

Open3DIS: 基于 2D 掩码引导的开放词汇 3D 实例分割

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-12-17T00:00:00Z

本文提出全能视觉多任务适配器(VMT-Adapter)用于计算机视觉任务,通过共享任务知识增强跨任务交互,保留任务特定知识。同时提出VMT-Adapter-Lite以减少可训练参数。实验证明VMT-Adapter(-Lite)相对改进3.96%(1.34%),仅利用预训练模型约1%(0.36%)的可训练参数。

VMT-Adapter: 多任务强化学习的参数高效迁移学习

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-12-14T00:00:00Z

本文提出了一种名为混合动态变分自编码器(MixDVAE)的潜在变量生成模型,用于建模多个移动源组成的系统的动态。通过在单源数据集上预训练DVAE模型来捕捉源的动态,然后将多个预训练DVAE模型的实例集成到一个多源混合模型中,带有离散观测-源分配潜变量。实验结果表明,该方法在计算机视觉任务和音频处理任务上表现良好,并超过了几种基准方法。

多源轨迹建模与分离的动态变分自编码器混合

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-12-07T00:00:00Z

该文章提出了一种学习判别特征的框架,以改进人群计数模型的定位能力和区分前景与背景的能力。该框架包括掩蔽特征预测模块和像素级对比学习模块,对计算机视觉任务有潜在的性能提升效果。

学习用于人群计数的判别特征

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-11-08T00:00:00Z

InstructDiffusion是一个用于将计算机视觉任务与人类指令对齐的通用框架。通过扩散过程训练模型以预测像素,它能够处理各种视觉任务,并在新数据集上表现优于先前的方法。这将推进计算机视觉领域的人工智能通用建模接口的发展。

InstructDiffusion: 一个用于视觉任务的通用建模接口

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-09-07T00:00:00Z

本文介绍了一种保护隐私的自动驾驶方法,通过将图像和标签转换为鱼眼样式的数据,优化了深度学习模型的计算机视觉任务。实验结果表明,该方法在自动驾驶数据上训练时表现优于基线方法。

FisheyePP4AV:自动驾驶车辆上鱼眼摄像头图像的隐私保护方法

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-09-07T00:00:00Z

该研究介绍了Convolutional Dense Attention-guided Network (CDAN)的工作原理和应用,通过图像增强技术改善了低光照条件下的图片质量,并在计算机视觉任务中展示了潜力,特别是在低光照条件下的目标检测和识别方面。

CDAN:用于低光图像增强的卷积稠密注意力引导网络

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-08-24T00:00:00Z

本研究评估了计算机视觉任务中彻底自监督学习技术的有效性,并提出了一种基于标注块的零样本分割评估协议。通过MMC方法,利用蒙版图像建模、自蒸馏和全局对比度提升SSP ViTs的区分能力,实现了零样本语义分割的顶级效果。

掩蔽动量对比学习用于零样本语义理解

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-08-22T00:00:00Z

本文介绍了一种名为DR-Net的新型深度网络架构,用于图像去雾。该网络由三个子网络组成,分别是传输预测网络、去雾网络和优化网络。DR-Net在数据驱动模型、端到端系统和鲁棒性方面表现出色。实验证明,DR-Net在定量和定性指标上都优于最新方法。此外,DR-Net在计算机视觉任务中也具有潜在用途。

水下图像增强的传输和颜色引导网络

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-08-09T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码