小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
FurnitureVLA——利用VLA学习长时域双臂家具装配:将装配长时任务拆分为多个子步骤,且提出进度VLA,以预测每个子任务的进度信号,最终实现子任务之间的切换

本文研究了利用视觉-语言-动作模型(VLA)进行真实尺度双臂家具装配。作者开发了双臂仿真流水线和VR远程操控系统,以生成高质量示教数据。通过将装配过程分解为语义子任务,优化了装配的精度和效率,解决了误差累积问题。研究还强调了设计因素对装配成功率的影响,并提出了一种进度增强型VLA模型以实现自动化子任务切换。

FurnitureVLA——利用VLA学习长时域双臂家具装配:将装配长时任务拆分为多个子步骤,且提出进度VLA,以预测每个子任务的进度信号,最终实现子任务之间的切换

结构之法 算法之道
结构之法 算法之道 · 2026-07-13T13:12:45Z
智谱发布并开源新旗舰模型GLM-5 旨在应对复杂系统工程和长时域智能体任务

智谱发布并开源GLM-5模型,参数规模达到7440亿,显著提升复杂系统工程和长时域智能体任务的性能。GLM-5在多项基准测试中优于其他开源模型,缩小与前沿模型的差距,支持MIT许可证,任何人均可使用。

智谱发布并开源新旗舰模型GLM-5 旨在应对复杂系统工程和长时域智能体任务

蓝点网
蓝点网 · 2026-02-12T02:49:41Z

本研究解决了现有数据驱动算法未考虑智能电表数据质量的问题,缺乏异常检测机制,无法有效区分异常数据的特征。文章提出了一种基于Isolation Forest算法和快速傅里叶变换过滤的异常检测框架,能够在时域和频域内有效识别和减轻异常数据对电力消耗数据的影响。这一方法的引入对于高比例智能电表的配电网络分析具有重要意义。

基于时域和频域的智能电表数据异常检测研究

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2025-04-25T00:00:00Z

本研究提出了一种新的价值迭代算法,旨在提高线性马尔可夫决策过程的计算效率。该算法通过计算访问过的状态集的价值函数最小值,显著提升了效率,并保持了遗憾界限。这一方法有助于在广泛状态空间中有效应用强化学习。

一种针对无限时域平均奖励线性马尔可夫决策过程的计算高效算法

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2025-04-16T00:00:00Z

本研究针对强化学习在学习新任务时忽视先验知识的问题,提出了一种通过贝叶斯非参数模型有效捕捉技能多样性的先验知识方法。研究表明,使用这种灵活的技能先验,能够显著提升机器人的学习和执行能力,尤其是在复杂的长时域任务中,促进技能转移和任务成功。

预训练的贝叶斯非参数知识先验在机器人长时域强化学习中的应用

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2025-03-27T00:00:00Z

本研究提出了一种双时域通道注意力机制(DTA),旨在解决脉冲神经网络在时间信息利用方面的挑战。实验结果表明,DTA在静态和动态数据集上表现优异,增强了脉冲表示与时间通道关系的捕获能力。

双时域通道注意力机制用于脉冲神经网络

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2025-03-13T00:00:00Z
清华团队新算法玩转频域时域,压缩95%计算量实现语音分离新SOTA!

清华大学研究团队提出了轻量级语音分离模型TIGER,结合时频交叉建模和频带切分策略,显著提升了语音分离效果。新数据集EchoSet更真实地模拟了复杂声学环境,实验结果表明TIGER在性能和效率上优于现有模型。

清华团队新算法玩转频域时域,压缩95%计算量实现语音分离新SOTA!

机器之心
机器之心 · 2025-02-14T05:08:05Z

该研究探讨了策略梯度方法在强化学习中的应用,分析了其收敛性和性能保证。结果表明,策略梯度算法在平均奖励马尔可夫决策过程中的收敛速度为O(log(T)),并提供了有限时间的性能保证,强调了与折扣奖励的区别。

具有一般状态和动作的有限时域MDP政策优化的概述

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-09-25T00:00:00Z

本研究解决了神经网络解释机制不透明的问题,提出了LMAC-TD,一种在时域直接生成解释的后处理方法。该方法通过结合SepFormer架构,显著提高了解释的音频质量,同时保持了解释的真实性。

LMAC-TD: 生成音频分类器的时域解释

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-09-13T00:00:00Z

本文介绍了一种基于时间变形对齐网络的视频超分辨率模型,能够动态预测采样卷积核偏移,从而实现高质量的视频重建。研究提出了循环残差网络和双向交互时空超分辨率等新方法,显著提升了计算效率和重建效果。实验结果显示,这些方法在不同视频长度和动态性下均表现优越。

级联时域更新网络用于高效视频超分辨率

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-08-26T00:00:00Z

本研究提出了一种基于去噪扩散概率模型的视频建模框架,能够生成长达25分钟的高质量视频。通过引入多种文本条件,扩展了文本驱动视频生成的能力,并提出了新的自我关注计算方式和语义运动预测模块,显著提升了视频生成效果。此外,研究探讨了低质量视频训练高质量模型的可行性,取得了显著成果。

FreeLong: 无需训练的长视频生成与 SpectralBlend 时域注意力

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-07-29T00:00:00Z

本文提出了一种新的时间链接预测方法,通过节点动态分析提高预测准确性,实验证明在合著网络中性能提升17.34%。研究探讨了动态图神经网络的时间粒度对性能的影响,并提出基于元学习的新模型以快速适应新节点,展示了在动态链接预测中的优越性。

动态图学习中的时域感受野:综合分析

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-07-17T00:00:00Z

本文介绍了一种高效的视频模型,结合自我关注和 S4 层的优点,显著提升了视频分类性能,速度快且内存占用少。通过长期特征库和高阶交互建模,改善了视频描述生成,取得了领先效果。此外,提出了新型监督学习技术和孪生 LSTM 结构,提升了视频摘要和行人匹配效果,在多个数据集上表现优越。

MeMSVD: 使用增量 SVD 捕捉长程时域结构

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-06-11T00:00:00Z

为了捕捉局部和全局依赖关系,我们在频域和时域中引入了频域与时域混合器 (FTMixer) 来表示时间序列数据,通过频率通道卷积模块 (FCC) 和窗口频率卷积模块 (WFC) 来分别捕捉全局和局部依赖关系。同时,采用独立通道方案混合时域和频域补丁以更好地捕捉局部依赖关系。通过七个真实世界的长期时间序列数据集的广泛实验结果表明,FTMixer 在预测性能和计算效率方面具有优势。

FTMixer:时间序列建模的频率和时域表示融合

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-05-24T00:00:00Z

RGNet 方法通过统一的跨模态 RG-Encoder 和稀疏采样技术,实现了对长视频中特定时刻的定位,超越了以往技术。研究中提出了 Deep Semantic Clustering Network 和 VLG-Net 等新方法,均在多个数据集上展示了优越性能,有效解决了视频时间定位的挑战。

统一的静态和动态网络:用于视频定位的高效时域滤波

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-03-21T00:00:00Z

本文提出了一种结合文本和音频条件的3D-VQGAN和transformers生成长视频的方法,强调多文本条件在视频生成中的重要性。新模型注重视觉一致性和动态噪声处理,实验结果显示其在语义一致性和时间连续性方面表现优异,拓宽了视频生成和编辑的能力。

VSTAR:用于长时间动态视频合成的生成时域护理

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-03-20T00:00:00Z

本文介绍了在第四届野外情感行为分析竞赛中提出的多任务学习方法,利用深度模型提取情感特征,显著提高了情感分类和评估的准确性。研究表明,基于Transformer的架构和EfficientNet模型在实时视频情感分析中表现优异,尤其在多模态特征提取和情感反应强度评估方面超越了基线方法。

利用掩模自编码器、时域卷积网络和转换器进行连续情感识别的自预训练强化

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-03-18T00:00:00Z

我们开发了一种创新的双路径耦合去雨网络(DPCNet),通过SFEBlock和FFEBlock在空间和频率域中整合信息,并引入了AFM进行双通路径特征聚合。该方法在六个公共去雨基准和下游视觉任务上进行了实验证明,超越了现有的最先进去雨方法,具有鲁棒性和视觉效果。

SFTformer: 雷达回波外推的空间频率时域相关解耦变压器

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-02-28T00:00:00Z

本文介绍了一种基于transformer-based网络的新框架,用于从EEG信号中获取注意状态。该网络经过训练和验证,在两个公共数据集上表现出比现有模型更好的效果。该框架可应用于评估注意力缺陷多动障碍(ADHD)症状或驾驶评估中的警觉度。

基于脑电图的阿尔茨海默病分类的光谱、时域和空间信息平衡

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-02-21T00:00:00Z

EmMixformer是一种混合Transformer,用于提取眼动识别的时域和频域信息,提高识别准确性。实验结果表明,EmMixformer在眼动数据集和两个公共眼动数据集上的性能优于现有技术。

EmMixformer: 混合变压器用于眼动识别

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2024-01-10T00:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码