小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
LALAL.AI推出Lynx:用于语音去噪的神经网络

LALAL.AI推出专为语音降噪设计的神经网络Lynx,能分离人声与背景噪音,生成干净人声轨道,节省后期制作时间。模型比旗舰版小六倍,基于人工整理数据训练。Lynx已上线,成为平台使用量第二大的分离音轨,预计2025年处理超1150万音频分割,未来将改进合唱分离和远距离语音隔离。

LALAL.AI推出Lynx:用于语音去噪的神经网络

实时互动网 实时互动网 · 2026-07-24T06:47:59Z
用 ONNX Runtime 在 WebRTC 客户端中集成实时的 AI 语音降噪与视频超分辨率

在实时通信领域,传统音视频处理算法面临瓶颈。随着轻量级神经网络的发展,将AI模型嵌入WebRTC客户端的媒体管道成为趋势。文章探讨了如何利用ONNX Runtime实现实时语音降噪和视频超分辨率,强调C++的高效性和ONNX的跨平台优势,并提供了性能优化建议,如使用libyuv和GPU零拷贝技术,以提升实时音视频体验。

用 ONNX Runtime 在 WebRTC 客户端中集成实时的 AI 语音降噪与视频超分辨率

实时互动网 实时互动网 · 2026-07-14T03:37:50Z
Waves Audio Clarix LB:用于直播的 AI 降噪插件

Waves Audio推出了AI驱动的语音降噪插件Clarix LB,旨在实时清除直播环境中的噪音,适合主播和记者。该插件兼容多种调音台,支持高达96 kHz的采样率和47毫秒的延迟,确保语音清晰。

Waves Audio Clarix LB:用于直播的 AI 降噪插件

实时互动网 实时互动网 · 2025-08-22T06:19:06Z

本研究提出了一种新网络架构Centaurus,旨在优化状态空间模型(SSM)的训练效率,从而提升关键词检测、语音降噪和自动语音识别等音频处理任务的性能。

Making State-Space Models Convolutional Networks: State-Space Modeling with Optimal Tensor Contractions

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2025-01-22T00:00:00Z

该研究探讨了多种语音处理模型的优化,包括单声道源分离、语音降噪和超分辨率。提出的模型SPMamba和Wave-U-Mamba在噪声环境中表现优异,处理速度显著提高,实验结果显示其在语音增强和分离任务中效果良好。

CleanUMamba:使用通道剪枝的紧凑型Mamba网络进行语音去噪

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-10-14T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码