小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
对比定位语言-图像预训练

CLIP方法用于训练视觉编码器生成图像和文本表示,但在细粒度视觉表示上有不足。本文提出CLOC方法,通过区域-文本对比损失提升CLIP的定位能力。CLOC引入可提示嵌入,设计视觉丰富的标注框架,生成大规模区域-文本伪标签,增强MLLMs在指代和定位任务中的表现。

对比定位语言-图像预训练

Apple Machine Learning Research
Apple Machine Learning Research · 2025-06-30T00:00:00Z

本研究提出了一种新型自监督学习框架,旨在提高介入X射线中设备(如导管、气球和支架)的检测精度。该方法通过结合补充线索和多表示空间,显著提升了设备标记的定位能力,气球标记检测误差减少87%,导管尖端检测误差减少61%。

A Novel Tracking Framework for Devices in X-ray Leveraging Supplementary Cue-Driven Self-Supervised Features

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2025-01-22T00:00:00Z

本文介绍了提升网络协议服务器定位能力的方法,包括CPU和内存分析、日志和网络连接关联、特征值跟踪和查看原始报文。讨论了网络报文与业务trace关联的重要性和实现挑战,以及抓包和解密TLS报文的挑战。建议考虑应用层抓包方案,并讨论了抓包地点选择、过滤条件设定和数据存储问题。

解决网络协议服务器问题的关键:定位能力与抓包技术

华为云官方博客
华为云官方博客 · 2023-12-25T09:54:54Z

UniVTG框架通过统一视频时序定位的标签和任务,提高定位能力。实验证明该框架在三项任务上有效灵活。

EtC:弱监督视频定位的时序边界扩展再澄清方法(Multimodal 大型语言模型)

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2023-12-05T00:00:00Z

该文章提出了一种学习判别特征的框架,以改进人群计数模型的定位能力和区分前景与背景的能力。该框架包括掩蔽特征预测模块和像素级对比学习模块,对计算机视觉任务有潜在的性能提升效果。

学习用于人群计数的判别特征

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2023-11-08T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码