小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
推出变革性的多摄像头视觉AI数据集

MultiScene360数据集是一个多摄像头视频数据集,旨在推动生成视觉AI应用,特别是3D数字人技术。它提供同步的多视角视频,支持数字人神经渲染、虚拟角色视图合成和动作转移,包含13种场景和4个同步摄像头视角,适用于开发更真实的虚拟角色和动画工具。

推出变革性的多摄像头视觉AI数据集

DEV Community
DEV Community · 2025-05-15T03:59:35Z
Meta AI 发布感知语言模型 (PLM): 用于解决视觉识别难题的开放式可复制视觉语言模型

Meta AI推出了感知语言模型(PLM),这是一个开放且可复现的视觉语言建模框架,支持图像和视频输入。PLM通过合成数据和人工标记数据进行训练,强调透明性和可评估性,集成了视觉编码器和不同参数的语言解码器,采用多阶段训练流程。PLM发布了两个高质量视频数据集,支持细粒度视频理解,并在多个基准测试中表现优异,推动了多模态人工智能研究。

Meta AI 发布感知语言模型 (PLM): 用于解决视觉识别难题的开放式可复制视觉语言模型

实时互动网
实时互动网 · 2025-04-21T02:46:48Z
人工智能行车记录仪数据集在真实条件下以87%的准确率预测汽车碰撞

该研究推出了一个新的行车记录仪视频数据集,包含5000个视频片段,用于汽车碰撞预测。其中3000个为无碰撞示例,2000个为有碰撞示例,涵盖多种车辆、天气和路况。基线模型在真实条件下的准确率为87%。

人工智能行车记录仪数据集在真实条件下以87%的准确率预测汽车碰撞

DEV Community
DEV Community · 2025-03-08T07:04:45Z

本研究提出了基于物理的异常检测(Phys-AD)数据集,旨在克服现有工业异常检测算法在静态数据集上的局限性。该数据集是首个大规模真实世界的物理基础视频数据集,结合物理知识和视频内容进行视觉推理,以识别物体异常。

Towards Visual Recognition and Reasoning of Real-World Physical Dynamics: Physics-Grounded Anomaly Detection

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2025-03-05T00:00:00Z

本文介绍了一个新的视频数据集,来源于城市高速公路的16个交通摄像头,包含57分钟的视频和87,700个3D边界框。该数据集用于多摄像头3D物体跟踪,具有挑战性,旨在推动车辆轨迹提取算法的发展。

ECCV 2024 ROAD++挑战赛第一名解决方案 @ ROAD++ 原子活动识别 2024

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-10-30T00:00:00Z

本研究提出了一种基于语言的搜索方法,通过双编码器和跨注意力的视觉文本变压器相结合,提高了图像和视频数据集的检索准确性和可扩展性。该方法在Flickr30K图像数据集和VATEX视频数据集上进行了验证。

T2VIndexer:一种高效文本-视频检索的生成视频索引器

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-08-21T00:00:00Z

本文构建了一个视频数据集,使用扩散式视频生成算法和多种语义内容生成退化样本。通过分析AI生成视频的时间缺陷,构建了一个新的检测框架,通过学习局部运动信息和全局外观变化来暴露伪造视频。实验评估了不同检测方法的泛化性和鲁棒性,结果可作为基线,并展示未来研究的挑战。

揭示人工智能生成的视频:基于本地和全局时间缺陷的检测方法与基准数据集

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-05-07T00:00:00Z

Ego-Exo4D是一个多模态多视图视频数据集和基准挑战,包含了来自全球13个城市的800多名参与者在131个不同的自然场景环境中进行的技能人类活动的自我中心和外部视角视频。该数据集具有多通道音频、眼动数据、3D点云、相机姿态、IMU数据和多个配对的语言描述等多模态特性。为了推进对技能人类活动的第一人视角视频理解的研究,提出了一系列基准任务及其标注。

背包里装满技能:多角度任务视角下的自我中心视频理解

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-03-05T00:00:00Z

本研究提出了一种新颖的视频理解任务方法,将基于知识的问题回答融合进来,并提出了一个关于情景喜剧的视频数据集。该数据集融合了视觉、文本和时间的连贯思维,需要观看该系列影片的体验知识才能回答基于知识的问题。同时,本文提出了一种能够将视觉和文本视频内容与剧集相关的具体知识相结合的视频理解模型。主要发现是融入知识可在视频问答方面产生卓越的改进,但仍需进一步研究提高准确度。

BDIQA:一个探索通过心智理论进行认知推理的视频问答新数据集

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-02-12T00:00:00Z

该论文介绍了一种名为NTrack的多物体追踪系统,利用自动化追踪技术独立于检测方法,实验证明其在棉铃追踪和计数方面的有效性超过其他方法,并公开了第一个棉铃视频数据集。

NTrack:一种适用于棉花田中的多目标跟踪器和数据集

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2023-12-18T00:00:00Z

该研究介绍了一个名为Cattle Visual Behaviors (CVB)的视频数据集,用于牛行为识别。通过计算机视觉标注工具(CVAT)收集了502个视频剪辑,每个剪辑15秒长,标注了11种牛的行为。使用预训练模型对视频中的牛进行检测和跟踪,并使用CVAT进行修正和标记,减少了标注时间和精力。最后,使用SlowFast动作识别模型对数据集进行训练和评估,能够准确识别牛的频繁出现的行为。

CattleEyeView: 一种用于智能精准畜牧农业的多任务自上而下视角的牛数据集

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2023-12-14T00:00:00Z

该研究介绍了一个名为REVIDE的视频数据集,包含清晰和有雾条件下的视频,同时提出了一种使用时间冗余的视频去雾算法,并使用变形金刚网络结构验证了所提出数据集的相关性。

一个用于对比去雾算法的新的真实世界视频数据集

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2023-10-02T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码