➡️
继续阅读
-
AI 智创简报:《说话人分离专利转向流式,转写接单者的工具活》
近一年,NVIDIA与Google公开了四项说话人分离专利,推动该技术从离线批处理转向流式处理,并引入大模型纠错。此技术旨在解决转写中“谁在何时说话”的难...
-
Qwen Audio:复杂人声干扰下,如何让 ASR “听对人”
本文探讨语音识别在多人环境中“听对人”的挑战,即区分用户与背景人声。对比两种技术路线:基于身份注册的Target-Speaker ASR和基于场景线索的前...
-
OpenAI admits to German wiki ‘incident’
OpenAI says it needs to overhaul how and when it reports instances of AI mode...
-
Robotaxis enter their villain era
It's Bullitt meets Christine meets Waymo. A new short film imagines a San...
-
Beyond Zero: Google Publishes Successor to BeyondCorp
In a recent research paper, Google introduced Beyond Zero, a “security model ...
-
现象学导论
顾名思义,本书是介绍「现象学」这一哲学分支的专著。作者索科罗斯基是美国天主教大学的哲学教授,我去看他在豆瓣上的照片,也是身穿黑袍的模样。不难理解,这本书其...