➡️
继续阅读
-
DiscoSign:话语感知的文本到手语注解翻译
DiscoSign提出话语感知的文本到手语注解翻译框架,基于大语言模型处理空间指代、问答从句和概念注解一致性,并引入新评估指标。实验表明,该方法提升空间一...
-
OpenAI的安全系统已在任务中途切断API响应
OpenAI正考虑放缓最先进AI模型的开发,并可能与其他前沿实验室协调。此前研究员Coxon从Anthropic辞职,警告行业竞速过快、安全失控。Open...
-
谷歌支持的三个项目在第83届威尼斯国际电影节首映。
谷歌100 ZEROS团队在威尼斯电影节支持三个XR项目,均可在Android XR体验,结合Gemini对话AI、空间电影与3D立体技术拓展叙事,包括安...
-
CocktailASR-1 开源:目标说话人识别更像一个工程问题了
小米开源CocktailASR-1,聚焦目标说话人语音识别:指定要识别的说话人后,模型只输出该人内容,而非还原全部声音,更贴近会议、车载、客服等场景。文章...
-
OpenClaw v2026.9.4更新:插件发现和技能学习功能
OpenClaw v2026.9.4发布,包含1558个合并请求。核心更新:插件与技能统一搜索,AI可在聊天中主动推荐;技能工坊通过提案机制让用户审查AI...
-
Firecrawl 如何帮助我们的销售团队打造定制化产品演示
Mux Robots 团队为解决传统功能演示难以打动客户的问题,使用 Firecrawl 抓取客户官网的品牌视觉、业务背景和视频机会,自动生成带有客户品牌...