小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
GPT-Red:解锁自我提升以增强鲁棒性

GPT-Red是一个自动化的红队模型,旨在发现和修复AI模型的漏洞。通过自我训练,GPT-Red能够生成有效的攻击,提升模型的鲁棒性。与人类红队相比,GPT-Red在多种场景中表现更佳,成功率显著提高。最新的GPT-5.6模型在抵御攻击方面取得了显著进展,未来将继续优化安全性和可靠性。

GPT-Red:解锁自我提升以增强鲁棒性

OpenAI
OpenAI · 2026-07-15T10:00:00Z
一分钟读论文:《AgentGym2——从理想化基准到真实世界部署的评估范式转移》

构建生产级AI智能体时,传统基准测试无法反映真实环境的挑战。AgentGym2提出去理想化评估,强调端到端执行、工具发现和组合能力。测试显示,GPT-5等模型在真实场景中表现不佳,需关注探索能力和鲁棒性。未来应重视专门训练和多样化基准评估,以提升AI在复杂环境中的表现。

一分钟读论文:《AgentGym2——从理想化基准到真实世界部署的评估范式转移》

Micropaper
Micropaper · 2026-07-08T00:00:00Z
关于强化学习微调视觉语言模型的鲁棒性与思维连贯性

强化学习微调的视觉语言模型在视觉推理基准上有所提升,但仍受到视觉基础薄弱、幻觉和文本线索过度依赖的影响。简单的文本扰动显著降低了模型的鲁棒性和信心。开放源代码模型在连贯性方面表现不佳,而封闭模型则更为稳健。微调提高了基准准确性,但可能削弱推理的可靠性。建议采用关注忠实度的奖励机制,以改善推理的准确性和鲁棒性。

关于强化学习微调视觉语言模型的鲁棒性与思维连贯性

Apple Machine Learning Research
Apple Machine Learning Research · 2026-07-02T00:00:00Z
反因果领域泛化:利用无标记数据

本文探讨了反因果领域泛化,旨在提高模型在新环境中的鲁棒性。研究提出利用无标记数据,通过惩罚模型对环境扰动的敏感性来增强适应性。提出的两种方法在特定环境下具有最优性,并在实际系统和生理信号数据集上验证了效果。

反因果领域泛化:利用无标记数据

Apple Machine Learning Research
Apple Machine Learning Research · 2026-07-02T00:00:00Z
视频指纹识别技术的工作原理:识别每一帧画面的技术

视频指纹识别技术通过分析视频的色彩、亮度和运动特征,有效识别盗版视频,具有高鲁棒性,无需修改原始内容。该技术广泛应用于版权管理和内容识别,确保视频内容的保护和监控。

视频指纹识别技术的工作原理:识别每一帧画面的技术

实时互动网
实时互动网 · 2026-05-27T03:28:46Z
构建具有错误恢复功能的多工具Gemma 4代理

本文介绍了构建具有错误恢复功能的多工具Gemma 4代理的方法。重点包括设计迭代代理循环、处理工具调用中的四种失败类型,以及创建有效的错误消息以帮助模型恢复。通过捕获错误并转化为可读消息,模型能够决定是否重试或解释失败,从而提高代理的鲁棒性,最终实现一个能够优雅处理问题的代理系统。

构建具有错误恢复功能的多工具Gemma 4代理

MachineLearningMastery.com
MachineLearningMastery.com · 2026-05-26T12:00:51Z
ICLR 2026 丨单任务可训练参数减少 125 倍!新方法 Task Tokens 助力具身智能提升复杂任务能力

以色列理工学院的研究团队提出了一种名为 Task Tokens 的方法,旨在高效适配行为基础模型(BFM)到特定任务。该方法通过减少可训练参数和提高收敛速度,保持了模型的灵活性和泛化能力。实验表明,Task Tokens 在多种任务中表现优异,尤其在应对环境变化时展现出更强的鲁棒性。

ICLR 2026 丨单任务可训练参数减少 125 倍!新方法 Task Tokens 助力具身智能提升复杂任务能力

HyperAI超神经
HyperAI超神经 · 2026-04-23T05:28:20Z
一分钟读论文:《MASS-RAG:多智能体协同的检索增强生成》

论文《MASS-RAG: Multi-Agent Synthesis Retrieval-Augmented Generation》提出了一种多智能体协同处理检索证据的方法,旨在提高在噪声和异构上下文下的答案准确性。该方法将证据处理分为四个阶段,由不同智能体完成,显著降低了幻觉率并增强了鲁棒性,适用于多种场景。

一分钟读论文:《MASS-RAG:多智能体协同的检索增强生成》

Micropaper
Micropaper · 2026-04-22T00:00:00Z
RISE——组合式世界模型驱动的RL框架:基于视频扩散模型预测的未来视觉状态,和VLA估计的进度价值评估,以先离线预热后在线改进

RISE是一个通过想象进行机器人强化学习的框架,旨在提升视觉-语言-动作模型在复杂任务中的鲁棒性。它结合动力学预测和价值估计,利用组合式世界模型生成高效学习信号,表现优于传统强化学习方法,能够有效应对动态适应性和精确性要求的任务。

RISE——组合式世界模型驱动的RL框架:基于视频扩散模型预测的未来视觉状态,和VLA估计的进度价值评估,以先离线预热后在线改进

结构之法 算法之道
结构之法 算法之道 · 2026-02-18T15:07:31Z
χ0——解决数据收集、模型训练、策略部署三者分布之间的不一致性:完成衣服的摊平、折叠、悬挂等多种任务

文章探讨了机器人操作中的分布不一致性问题,提出了χ0框架,通过模型算术、阶段优势和训练-部署对齐等技术,提高机器人在复杂任务中的鲁棒性和效率。重点在于如何有效利用有限的数据和示范,优化机器人学习与执行策略,以提升任务成功率和稳定性。

χ0——解决数据收集、模型训练、策略部署三者分布之间的不一致性:完成衣服的摊平、折叠、悬挂等多种任务

结构之法 算法之道
结构之法 算法之道 · 2026-02-17T15:58:20Z

蚂蚁推出AlignXplore+,通过文本化用户建模实现个性化,突破传统推荐系统的局限。该模型具备全域通用、极致迁移和实战适配三大特性,能够有效理解用户偏好,提升个性化应用的准确性和鲁棒性。

蚂蚁用8B小模型构建用户“话”像,跨任务跨模型通用且SOTA

量子位
量子位 · 2026-01-31T12:36:45Z
IEEE TASLP | FPO: 细粒度偏好优化提升零样本TTS鲁棒性

近年来,零样本文本转语音(TTS)系统取得进展,但仍存在局部错误。西工大与喜马拉雅合作提出细粒度偏好优化(FPO),有效修复问题片段,提升语音合成的鲁棒性和数据效率。实验结果显示,FPO在可懂度和自然度上显著优于传统方法。

IEEE TASLP | FPO: 细粒度偏好优化提升零样本TTS鲁棒性

实时互动网
实时互动网 · 2026-01-05T03:19:58Z

原力灵机的GeoVLA框架解决了VLA模型在非结构化环境中的空间失明问题,通过双流架构结合点云数据,提升了机器人的三维感知能力。实验表明,GeoVLA在复杂任务中的成功率显著高于传统2D模型,尤其在视角和物体尺寸变化时表现出强大的鲁棒性。

原力灵机提出GeoVLA:让机器人看懂三维世界,打破2D视觉枷锁

量子位
量子位 · 2025-12-24T13:35:37Z
大模型剪枝新范式:先浓缩,再剪枝——DenoiseRotator技术解读

DenoiseRotator是一种新型的大模型剪枝技术,通过“重要性浓缩”优化参数分布,增强剪枝的鲁棒性并减少性能损失。该方法与现有剪枝算法兼容,已在NeurIPS会议上发表,适用于大规模语言模型的高效压缩。

大模型剪枝新范式:先浓缩,再剪枝——DenoiseRotator技术解读

美团技术团队
美团技术团队 · 2025-12-19T00:00:00Z
人工智能学习记录:流派、发展与应用挑战

单位举办了《人工智能的发展、现状与未来》培训,张钹教授主讲,内容包括AI定义、发展阶段及核心流派,探讨行为主义与内在主义的差异,以及知识驱动与数据驱动AI的特点与局限。大语言模型如ChatGPT展现技术高度,但存在幻觉与不可解释性问题。AI在医疗、网络安全等领域应用初步,但鲁棒性不足,未来需在类脑计算等方面持续探索。

人工智能学习记录:流派、发展与应用挑战

非学·派
非学·派 · 2025-12-17T06:25:14Z
人工智能学习记录:流派、发展与应用挑战

单位举办了《人工智能的发展、现状与未来》培训,张钹教授讲解了AI的核心流派、技术阶段及大语言模型的特征与缺陷。AI分为行为主义和内在主义,经历知识驱动和数据驱动两个阶段。大语言模型如ChatGPT展现了技术高度,但存在幻觉和不可解释性问题。AI在医疗、网络安全等领域的应用初步,但鲁棒性不足,未来需探索类脑计算等方向。

人工智能学习记录:流派、发展与应用挑战

非学·派
非学·派 · 2025-12-17T06:25:14Z
DeepTeam - 一个针对大型语言模型和LLM系统的开源红队框架,…

DeepTeam是一个针对大型语言模型的红队框架,旨在帮助研究人员识别安全和鲁棒性问题。它提供攻击策略、评估工具和可扩展的测试管道,以支持模型的安全性和质量评估,并促进社区的贡献。

DeepTeam - 一个针对大型语言模型和LLM系统的开源红队框架,…

云原生
云原生 · 2025-12-01T08:41:45Z

公网服务脆弱,需加强网络攻击防御。对策包括设置读超时、内存高水位、预留空闲fd、忽略SIGPIPE信号、自动重连使用指数退避和抖动。传输敏感数据时应使用TLS,定期更新OpenSSL库并禁用不安全协议。健壮性需通过防护措施提升。

安全与鲁棒性

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2025-11-27T00:00:00Z
专家级特征工程:高风险模型的高级技术

本文介绍了三种高级特征工程策略:反事实特征、领域约束表示和因果不变特征,旨在构建稳健且可解释的高风险模型,适用于金融和医疗等关键领域。

专家级特征工程:高风险模型的高级技术

MachineLearningMastery.com
MachineLearningMastery.com · 2025-11-11T11:00:09Z

陶哲轩推荐AlphaEvolve,称其为数学发现的新工具。该系统解决了67个数学问题,超越人类最优解,自主发现新结构,展现出优越的可扩展性和鲁棒性,推动数学研究进展。

陶哲轩力推AlphaEvolve:解决67个不同数学问题,多个难题中超越人类最优解

量子位
量子位 · 2025-11-07T09:20:04Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码