小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI

本研究探讨了多类分类算法在安全关键应用中的误分类问题,提出了一种新型风险评估方法,该方法独立于模型和数据分布,易于实现,并在多种场景中显著提升了风险评估的准确性和可靠性。

An In-Depth Study of Risk Assessment in Multi-Class Classification Algorithms

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-12-05T00:00:00Z

本文提出了一个框架,用于评估机器生成内容的对抗性攻击对检测模型的影响。研究表明,现有模型在短时间内容易被误判为人类文本,尽管有一定的鲁棒性提升,但在实际应用中仍面临挑战,强调了对更准确检测方法的需求。

面向文本感知推荐系统的对抗性文本改写

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-08-01T00:00:00Z

Dynabench是一个开源平台,用于创建动态数据集和进行模型基准测试。它解决了模型在基准任务上表现出色但在简单挑战示例和实际场景中失败的问题。该平台通过人和模型操作创建了能够被目标模型误分类但另一个人不能误分类的示例。它的优点和解决动态基准测定作为新标准引起的潜在反对意见也被阐述。

Modyn: 动态数据集上的模型训练平台与样本级数据选择

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2023-12-11T00:00:00Z

本文介绍了一种简化梯度攻击的方法,通过多阶段攻击框架,只需较小子图即可使图神经网络误分类。同时,作者还提出了度同配改变指标来衡量对图数据的对抗攻击影响。

简洁高效的图部分对抗攻击:新的视角

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2023-08-15T00:00:00Z

本文介绍了一种简化梯度攻击的方法,通过多阶段攻击框架,在只需较小子图的情况下使图神经网络误分类。同时,作者还提出了度同配改变这一实用指标来衡量对图数据的对抗攻击的影响。

通过梯度聚合提升通用对抗干扰的泛化性能

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2023-08-11T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码