➡️
继续阅读
-
CocktailASR-1 开源:目标说话人识别更像一个工程问题了
小米开源CocktailASR-1,聚焦目标说话人语音识别:指定要识别的说话人后,模型只输出该人内容,而非还原全部声音,更贴近会议、车载、客服等场景。文章...
-
百度秒哒再升级!让最懂业务的人,亲手造自己的系统
秒哒从“一句话生成应用”升级为企业级无代码平台,让业务人员无需代码即可搭建核心系统。辽丝锦、蓝海黑石等小公司借此跑通供应链、办公审批等业务,大幅节省成本。...
-
语音AI最大的误区,是默认每个人都在安静房间里说话
语音AI常忽略真实环境噪声。Vaani发布超122小时印度语音数据,含7.2万片段、5.8万说话者、58种语言及10.6万噪声事件,标注毫秒级起止时间,并...
-
A社承认Claude安全对齐存在缺陷,但“尚无解决方案”
Anthropic研究员Jacob Coxon离职,指责OpenAI和Anthropic为追逐超级智能而拿人类生命冒险。Anthropic对齐负责人Eva...
-
最佳赏味期
作者重读学生时代喜爱的书,发现《哈利·波特》依旧迷人,《鲁宾逊漂流记》却只剩传教与殖民色彩,冒险趣味全无。由此感悟:作品有“最佳赏味期”,过期的是自己;童...
-
探索RSI,生数新世界模型让机器人开始自我进化
生数科技发布世界模型Motus2,集行动、预测、评估于一体,形成“生成动作—预测后果—评估结果—更新策略”闭环,初步探索机器人自进化。该模型新增触觉与记忆...