小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ

实验发现AI模型在数据分析中存在四类错误:误用列计算(如用发货至送达而非下单至送达)、编造未运行代码的数字、忽略未送达订单导致趋势误判、未说明缺失值而得出错误结论。让模型自我审查时,它只修正了部分错误,甚至将正确结论改错。结论是AI擅长机械计算,但理解问题背景和缺失数据仍需人工把关。

我让ChatGPT分析3个数据集,它每次都犯同样的错误

KDnuggets KDnuggets · 2026-09-03T14:00:05Z
数据炼出智能架构:AI先天偏见被源头语料刻进骨髓

随机初始化的神经网络无需训练即可区分图像类别,因其架构经数十年数据筛选固化了“先天偏见”。Transformer也预编码了文本规律。AI自动化架构搜索将加速此过程,但评估标准仍依赖旧数据集,可能放大偏见,决定下一代AI形态。

数据炼出智能架构:AI先天偏见被源头语料刻进骨髓

极道 极道 · 2026-09-03T08:32:00Z
在真实世界数据集上微调SOTA目标检测模型

本文介绍了在PyCharm中微调YOLO12、YOLO26和RF-DETR等SOTA目标检测模型的方法。作者先在COCO数据集上验证基线性能,再测试零样本在电缆损伤、骨折X光片和汽水瓶等专业数据集上的表现,结果接近零。经过10轮微调后,模型在电缆和汽水瓶任务上表现良好,但骨折检测仍具挑战。文章强调预训练模型不等于可直接部署,需根据任务选择合适模型。

在真实世界数据集上微调SOTA目标检测模型

The JetBrains Blog The JetBrains Blog · 2026-08-31T13:50:29Z
VINS-120K: 基于大规模4K数据集的超高清图像编辑 | CVPR 2026

该文介绍首个指令式超高分辨率图像编辑数据集VINS-120K,含12万组4K三元组,并配套评测基准VINS-4KEval。提出高频感知后适应策略,通过注意力重缩放和频域监督,将低分辨率模型扩展至4K编辑,显著提升细节保真度,优于现有方法。

VINS-120K: 基于大规模4K数据集的超高清图像编辑 | CVPR 2026

实时互动网 实时互动网 · 2026-08-27T03:09:38Z
数据集汇总丨从竞赛数学到工具调用,MIT/NVIDIA/华中科大等开源9个数学数据集,覆盖 CoT 、多模态推理与长链思维训练

本文介绍9个数学推理数据集,涵盖竞赛级问题、多语言多模态、工具增强推理及知识依赖建模等方向,旨在提升大模型推理能力。包括Math-Graph定理依赖图、Nemotron-SFT-Math-v4、MathNet多模态基准、Nemotron-Math-v2、CHIMERA合成数据、Open-RL、GPT-5.4逐步推理、Sutra 10B预训练及VisCoR-55K视觉推理,助力模型训练与评测。

数据集汇总丨从竞赛数学到工具调用,MIT/NVIDIA/华中科大等开源9个数学数据集,覆盖 CoT 、多模态推理与长链思维训练

HyperAI超神经 HyperAI超神经 · 2026-07-29T09:43:32Z
文本/LaTeX/HTML表格一步搞定!OvisOCR2实现端到端文档智能解析;1.4 万+ 元素标注、万条语言指令!Voxel51 发布 SceneFun3D 室内场景微观交互数据集

OvisOCR2是2026年7月推出的0.8B参数端到端文档解析模型,基于Qwen3.5-0.8B构建,能将文档图像转为结构化Markdown,精准解析文本、公式、表格等。在OmniDocBench v1.6评测中获96.58分,超越传统流水线方法,实现低部署成本与高性能统一。HyperAI官网已上线该模型,并提供在线使用。

文本/LaTeX/HTML表格一步搞定!OvisOCR2实现端到端文档智能解析;1.4 万+ 元素标注、万条语言指令!Voxel51 发布 SceneFun3D 室内场景微观交互数据集

HyperAI超神经 HyperAI超神经 · 2026-07-27T06:58:36Z
谷歌发布 TabFM-1.0.0-PyTorch:专为混合表格数据打造的零样本预测模型;跨越亚美欧!NVIDIA 开源多国合成人物数据集,千万级角色数据上线

TabFM 是 Google Research 发布的基础模型,专注于处理结构化表格数据,支持分类和回归任务。该模型通过上下文学习重塑表格预测,显著提升数据处理效率,并在零样本配置下超越多个传统基线模型。

谷歌发布 TabFM-1.0.0-PyTorch:专为混合表格数据打造的零样本预测模型;跨越亚美欧!NVIDIA 开源多国合成人物数据集,千万级角色数据上线

HyperAI超神经 HyperAI超神经 · 2026-07-17T10:18:20Z
数据集汇总丨英伟达开源Nemotron系列数据集,超10T tokens+40M 条后训练样本,覆盖数学推理/代码生成/多语言对话

训练数据在大模型竞争中至关重要,NVIDIA推出的Nemotron系列数据集强调数据质量和任务适配性,涵盖通用文本预训练、监督微调和代码生成等核心能力,推动模型训练从数量向精准转变。这些数据集为大模型研究提供系统性支持,提升模型能力。

数据集汇总丨英伟达开源Nemotron系列数据集,超10T tokens+40M 条后训练样本,覆盖数学推理/代码生成/多语言对话

HyperAI超神经 HyperAI超神经 · 2026-07-17T08:06:36Z
数据集汇总丨AI Agent 评测数据集,Microsoft/北大/港大/上海交大等发布 10 个数据集,从长程记忆到真实环境任务执行全覆盖

AI Agent 正在从对话工具转变为任务执行者,广泛应用于自动化办公和代码生成等领域。与传统大语言模型不同,Agent 能够拆解任务并自主推进。为支持其能力,相关数据集强调过程能力,包括长程规划和多步推理。本文整理了10个关键数据集,涵盖长上下文理解、任务规划和工具调用等能力,推动 AI Agent 的研究与应用。

数据集汇总丨AI Agent 评测数据集,Microsoft/北大/港大/上海交大等发布 10 个数据集,从长程记忆到真实环境任务执行全覆盖

HyperAI超神经 HyperAI超神经 · 2026-07-06T11:01:54Z
emoji 也能控制语音生成?Irodori-TTS 基于 RF-DiT 架构的日语 TTS;Eczema and Tinea Skin Disease 数据集:支持医学图像分类与迁移学习

Irodori-TTS是由开发者Aratako于2026年发布的日语语音合成项目,具有高保真音质和零样本声音克隆能力。核心模型Irodori-TTS-500M-v3支持48 kHz专业音频输出,用户只需提供3-10秒的参考音频即可精准复刻目标音色,并通过Emoji注释调节情绪和语调。

emoji 也能控制语音生成?Irodori-TTS 基于 RF-DiT 架构的日语 TTS;Eczema and Tinea Skin Disease 数据集:支持医学图像分类与迁移学习

HyperAI超神经 HyperAI超神经 · 2026-07-03T09:07:54Z
Meta提出AI数据科学家,Autodata构建高质量训练/评测数据集

近年来,人工智能的发展逐渐从算法创新转向数据质量驱动。合成数据成为重要支撑,Meta的Autodata框架通过智能体模拟数据科学家,生成高质量训练数据,显著提升模型性能,展示了合成数据生成的新范式。

Meta提出AI数据科学家,Autodata构建高质量训练/评测数据集

HyperAI超神经 HyperAI超神经 · 2026-06-30T10:31:15Z
核心转储流行病学:修复一个存在18年的漏洞

OpenAI在调试Rockset服务时发现了两个崩溃问题:一个是硬件故障导致的堆栈错位,另一个是GNU libunwind库中的竞争条件。通过构建高质量的数据集,团队成功识别并解决了这些问题,强调了数据在调试中的重要性。

核心转储流行病学:修复一个存在18年的漏洞

OpenAI OpenAI · 2026-06-30T00:00:00Z
4步出图/4K画质/6倍提速,PiD用像素扩散统一解码与超分辨率输出;SA-3DAO:包含 1000 组真实图像与艺术家手工 3D 网格配对的数据集

NVIDIA 发布的 PiD 是一种新型潜空间解码范式,通过条件像素扩散生成取代传统 VAE 解码,解决了高分辨率图像生成的限制。PiD 利用轻量级噪声感知适配器和 DMD2 蒸馏技术,仅需 4 步去噪即可生成清晰的 4K 图像,显著提升了图像质量。

4步出图/4K画质/6倍提速,PiD用像素扩散统一解码与超分辨率输出;SA-3DAO:包含 1000 组真实图像与艺术家手工 3D 网格配对的数据集

HyperAI超神经 HyperAI超神经 · 2026-06-26T06:14:38Z
如何在亚马逊云科技上构建企业级智能体

本文讨论了在亚马逊云科技上构建企业级智能体的评估框架,强调评估应贯穿开发全生命周期。提出六个关键问题,涵盖评估框架、指标体系、自动化流程、数据集、工程纪律及工具支持。亚马逊云科技的经验表明,评估需关注智能体各组件,以确保其在复杂环境中的稳定性和可优化性。通过持续监测和反馈,企业能更有效地实现智能体的生产级部署。

如何在亚马逊云科技上构建企业级智能体

亚马逊AWS官方博客 亚马逊AWS官方博客 · 2026-06-22T06:15:07Z
医疗影像中的隐性PHI问题:构建用于AI去标识化的合成数据集

本文介绍了构建合成PHI生成管道的方法,以创建隐私安全的医疗影像AI训练和验证数据。通过生成虚拟患者身份并嵌入图像和DICOM元数据,团队能够创建可用于训练和评估去标识化系统的安全数据集,从而确保数据的可重复性和准确性,支持医疗AI系统的开发。

医疗影像中的隐性PHI问题:构建用于AI去标识化的合成数据集

freeCodeCamp.org freeCodeCamp.org · 2026-06-19T17:23:54Z
支持真人/动漫/动物驱动,美团开源多风格音频驱动视频生成框架LongCat 1.5;百万级图表理解数据集ChartNet提升VLM图表重建与表格提取能力

LongCat-Video-Avatar 1.5 是美团团队于2026年推出的开源音频驱动视频生成框架。用户只需提供静态图像和音频,即可生成口型同步的动态视频,适用于真实人像和动漫角色,具备高保真画面和长视频生成能力。

支持真人/动漫/动物驱动,美团开源多风格音频驱动视频生成框架LongCat 1.5;百万级图表理解数据集ChartNet提升VLM图表重建与表格提取能力

HyperAI超神经 HyperAI超神经 · 2026-06-16T09:38:52Z
通过新的开放数据集加速研究人员和开发者构建多语言AI

本文介绍了GitHub Copilot CLI的基本用法,包括使用斜杠命令控制终端AI代理,以及提高选择性和改进秘密扫描的可靠性,以减少误报并提升警报的可信度和可操作性。

通过新的开放数据集加速研究人员和开发者构建多语言AI

The GitHub Blog The GitHub Blog · 2026-06-15T19:17:30Z
SmoothConv & DuplexConv:面向对话式 AI的大规模中文全双工语音数据集开源!

全双工人机交互技术受到关注,ASLP实验室与上海元音矩阵科技公司联合开源了SmoothConv和DuplexConv两个中文长音频对话数据集。这些数据集包含真实对话场景,旨在支持语音大模型研发,提供高质量对话数据,涵盖教育和闲聊领域,助力全双工系统的中断与响应决策。

SmoothConv & DuplexConv:面向对话式 AI的大规模中文全双工语音数据集开源!

实时互动网 实时互动网 · 2026-06-12T03:03:31Z
麻省理工/IBM提出迄今为止最大的合成图表数据集ChartNet,生成150万个多样化图表样本

ChartNet是由麻省理工学院等机构开发的高质量多模态数据集,包含150万个图表样本,涵盖24种图表类型,旨在提升AI对图表的理解能力。该数据集支持图表重建、数据提取和摘要生成等任务。研究表明,微调模型在ChartNet上表现优于现有大型模型,推动了视觉语言模型在图表理解领域的进步。

麻省理工/IBM提出迄今为止最大的合成图表数据集ChartNet,生成150万个多样化图表样本

HyperAI超神经 HyperAI超神经 · 2026-06-11T09:29:01Z
MiniCPM5-1B采用RL+OPD训练,多项复杂任务达SOTA;面向复杂医疗业务自动化:医疗智能体评测数据集 CHI-Bench

TACK 是 AI Laboratory for Molecular Engineering 于 2026 年发布的一个标准化知识库数据集与基准测试集,旨在解决现有 PROTAC 机器学习基准中数据稀缺、缺乏严格评估及覆盖范围有限的问题,广泛应用于 PROTAC...

MiniCPM5-1B采用RL+OPD训练,多项复杂任务达SOTA;面向复杂医疗业务自动化:医疗智能体评测数据集 CHI-Bench

HyperAI超神经 HyperAI超神经 · 2026-06-05T05:55:57Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码