小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
NVIDIA 发布 NemotronLabs VoiceChat 11B:一款开放式全双工语音对语音模型

NVIDIA发布开源11B端到端语音模型NemotronLabs VoiceChat 11B,支持实时全双工对话,延迟仅448毫秒,可插话和调用工具。需80GB GPU,仅供研究,未用于生产。在基准测试中表现优异,但存在音频时长限制和语音降级等问题。

NVIDIA 发布 NemotronLabs VoiceChat 11B:一款开放式全双工语音对语音模型

实时互动网 实时互动网 · 2026-08-10T02:30:38Z
我们如何在六个月内构建出响应式语音AI的实时系统

GPT-Live是OpenAI第三代语音系统,采用全双工架构,无需独立语音检测器,可同时听和说。系统通过流式推理、异步委派、动态上下文管理和WARP协议优化,实现低延迟自然对话。它支持调用GPT-5.5等模型进行深度推理,并已通过静默测试验证生产环境可靠性。

我们如何在六个月内构建出响应式语音AI的实时系统

OpenAI OpenAI · 2026-08-03T07:00:00Z
阿里通义Wan-Streamer v0.2:响应延迟仅550ms,让 AI 真正与你”面对面”

阿里通义实验室发布的Wan-Streamer v0.2实现了低延迟、全双工的AI视频通话,响应时间约550毫秒。该模型整合音视频输入,实时理解并生成自然对话,画质提升至640×368,适用于AI助手、教育和游戏NPC等多种场景。通过流式架构,AI与用户的互动更加自然,逐步接近真实交流。

阿里通义Wan-Streamer v0.2:响应延迟仅550ms,让 AI 真正与你”面对面”

实时互动网 实时互动网 · 2026-07-17T09:40:30Z
SmoothConv & DuplexConv:面向对话式 AI的大规模中文全双工语音数据集开源!

全双工人机交互技术受到关注,ASLP实验室与上海元音矩阵科技公司联合开源了SmoothConv和DuplexConv两个中文长音频对话数据集。这些数据集包含真实对话场景,旨在支持语音大模型研发,提供高质量对话数据,涵盖教育和闲聊领域,助力全双工系统的中断与响应决策。

SmoothConv & DuplexConv:面向对话式 AI的大规模中文全双工语音数据集开源!

实时互动网 实时互动网 · 2026-06-12T03:03:31Z
消费级显卡可以快速上手跑!面壁智能MiniCPM-o 4.5发技术报告

面壁智能发布了MiniCPM-o 4.5,这是首个全双工全模态大模型,支持视频、音频和文本流输入,能够在个人电脑上运行,具备实时感知和主动交互能力,提升用户体验。该模型在多项评测中表现优异,适用于智能助手和无障碍服务,但在稳定性和复杂场景处理上仍有不足。

消费级显卡可以快速上手跑!面壁智能MiniCPM-o 4.5发技术报告

量子位 量子位 · 2026-04-28T14:50:10Z

本文解决了全双工口语对话模型在轮流交互能力评估方面的不足。提出了全双工基准(Full-Duplex-Bench),系统性评估对话行为如暂停处理、回馈、轮流发言和打断管理。研究表明该基准能够提供一致和可重复的评估,以促进口语对话建模领域的进步。

全双工基准:评估全双工口语对话模型的轮流能力

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2025-03-06T00:00:00Z
网络通信的实际工作原理

我研究了网络通信的三种主要模式:单工、半双工和全双工。单工为单向传输,半双工如对讲机,双方不能同时交流,而全双工则允许双向同时沟通,适用于现代网络和电话通话。这些模式影响网站加载和流媒体服务,理解它们有助于优化后端系统的性能与可扩展性。

网络通信的实际工作原理

DEV Community DEV Community · 2025-02-02T18:35:00Z
使用WitCom进行进程间通信

WitCom是一个为.NET设计的高效通信框架,支持服务接口定义和多种传输方式,结合了WCF的优点,提供全双工通信、加密和授权,适合遗留组件与现代平台的集成。

使用WitCom进行进程间通信

DEV Community DEV Community · 2025-01-13T10:47:45Z

本研究提出了一种新颖的无编码器全双工语音理解与生成框架SALMONN-omni,解决了传统对话AI系统组件分离的问题,并在语音识别和增强等任务中表现出色,推动了全双工对话AI系统的发展。

SALMONN-omni: An Encoder-Free Full-Duplex Speech Understanding and Generation Model

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-11-27T00:00:00Z

本研究提出OmniFlatten模型,旨在解决全双工对话系统中的低延迟和自然交互问题。通过三阶段后训练,该模型有效适应大型语言模型,实现实时文本和语音生成,为全双工语音对话系统的发展提供新方向。

OmniFlatten: An End-to-End GPT Model for Seamless Spoken Dialogue

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-10-23T00:00:00Z
Communication Protocol - SPI

SPI是一种全双工、同步、串行、主从、总线通信协议,数据传输速率为8 Mbit。SPI只能有一个主机,可连接一个或多个从机。优点包括全双工通信、推挽驱动、协议灵活、硬件设计简单、时钟速率没有上限。缺点是用到的引脚比I2C多、从机无法进行硬件应答、没有错误检查机制、只能有一个主机、传输距离相对比较近。

Communication Protocol - SPI

Power's Wiki Power's Wiki · 2023-10-02T11:35:00Z
通信协议 - SPI

SPI是一种全双工、同步、串行、主从、总线通信协议,数据传输速率为8 Mbit。SPI的引脚包括SCLK、SDI/SDO和CS/SS。SPI数据在SCLK上升或下降沿进行锁存,临界边沿为上升沿。SPI有4种传输模式,可驱动多个从机。优点包括全双工通信、推挽驱动、协议灵活,缺点包括引脚较多、无硬件应答、无错误检查机制。

通信协议 - SPI

Power's Wiki Power's Wiki · 2023-10-02T03:46:33Z

error[E0499]: cannot borrow `con` as mutable more than once at a time --> src/main.rs:58:41 | 49 | let mut ff = crate::FIXFactory::new(&mut con, &cfg, 1); | ...

一个关于redis连接借用的问题,难道要做成全双工?

Rust.cc Rust.cc · 2022-07-25T08:40:10Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码