➡️
继续阅读
-
CocktailASR-1 开源:目标说话人识别更像一个工程问题了
小米开源CocktailASR-1,聚焦目标说话人语音识别:指定要识别的说话人后,模型只输出该人内容,而非还原全部声音,更贴近会议、车载、客服等场景。文章...
-
Meta称在提出侵入性个人问题后正调整AI建议功能
Meta因AI提示功能引发隐私争议。一名用户发布与孩子唱歌的视频后,Meta AI提示“车里的孩子是谁”,并整合其过往帖子及亲属信息,推测孩子年龄和住址,...
-
百度秒哒再升级!让最懂业务的人,亲手造自己的系统
秒哒从“一句话生成应用”升级为企业级无代码平台,让业务人员无需代码即可搭建核心系统。辽丝锦、蓝海黑石等小公司借此跑通供应链、办公审批等业务,大幅节省成本。...
-
语音AI最大的误区,是默认每个人都在安静房间里说话
语音AI常忽略真实环境噪声。Vaani发布超122小时印度语音数据,含7.2万片段、5.8万说话者、58种语言及10.6万噪声事件,标注毫秒级起止时间,并...
-
讲讲 Duo 作为科技产品命名的前世今生
苹果发布折叠屏手机iPhone Duo,引发对“Duo”命名历史的回顾。1992年PowerBook Duo通过扩展坞实现便携与桌面切换,2020年Mag...
-
刚刚,Apple Watch 成为了苹果最新的 AI 硬件
苹果发布 Apple Watch S12、Ultra 4 与 AirPods 5,将手表和耳机升级为 AI 硬件。S12 搭载 S11 芯片,新增准备指数...