➡️
继续阅读
-
CocktailASR-1 开源:目标说话人识别更像一个工程问题了
小米开源CocktailASR-1,聚焦目标说话人语音识别:指定要识别的说话人后,模型只输出该人内容,而非还原全部声音,更贴近会议、车载、客服等场景。文章...
-
谷歌支持的三个项目在第83届威尼斯国际电影节首映。
谷歌100 ZEROS团队在威尼斯电影节支持三个XR项目,均可在Android XR体验,结合Gemini对话AI、空间电影与3D立体技术拓展叙事,包括安...
-
开源天气模型已经很快,真正的瓶颈却在数据
Hugging Face与Earthmover发布开源天气模型教程,以Aurora为例,展示从ERA5提取初始条件、执行24小时预测并计算误差的完整流程。...
-
A社承认Claude安全对齐存在缺陷,但“尚无解决方案”
Anthropic研究员Jacob Coxon离职,指责OpenAI和Anthropic为追逐超级智能而拿人类生命冒险。Anthropic对齐负责人Eva...
-
最佳赏味期
作者重读学生时代喜爱的书,发现《哈利·波特》依旧迷人,《鲁宾逊漂流记》却只剩传教与殖民色彩,冒险趣味全无。由此感悟:作品有“最佳赏味期”,过期的是自己;童...
-
探索RSI,生数新世界模型让机器人开始自我进化
生数科技发布世界模型Motus2,集行动、预测、评估于一体,形成“生成动作—预测后果—评估结果—更新策略”闭环,初步探索机器人自进化。该模型新增触觉与记忆...