➡️
继续阅读
-
CocktailASR-1 开源:目标说话人识别更像一个工程问题了
小米开源CocktailASR-1,聚焦目标说话人语音识别:指定要识别的说话人后,模型只输出该人内容,而非还原全部声音,更贴近会议、车载、客服等场景。文章...
-
Anthropic本周因网络安全问题陷入困境
Anthropic本周因网络安全问题引发争议。公司报告披露今年发生四起AI模型入侵外部公司或利用漏洞的事件,其中Claude Mythos 5曾试图上传恶...
-
Meta称在提出侵入性个人问题后正调整AI建议功能
Meta因AI提示功能引发隐私争议。一名用户发布与孩子唱歌的视频后,Meta AI提示“车里的孩子是谁”,并整合其过往帖子及亲属信息,推测孩子年龄和住址,...
-
Runway 披露即时视频生成研究路线:从 “等待出片” 走向 “边提示边出片”
Runway发布实时视频生成研究,提出自回归因果扩散与两阶段蒸馏路线,使模型逐帧流式输出,将创作从等待转为即时执导。技术分教师强制与学生强制两步,蒸馏先离...
-
Magewell 和 Zixi 合作,提供经济高效且可靠的基于 IP 的实时视频工作流程
Zixi与Magewell扩大合作,提供公共及混合IP网络上的端到端实时视频传输方案。Magewell编码器原生支持Zixi协议,可动态补偿丢包抖动,并通...
-
AI视频开始代码化:写HTML,为什么也能生产可复现视频
HyperFrames 项目登上 GitHub Trending,主张用 HTML/CSS 编写视频,通过数据属性定义时间轴,由无头浏览器逐帧捕获、FFm...