➡️
继续阅读
-
AI 智创简报:《说话人分离专利转向流式,转写接单者的工具活》
近一年,NVIDIA与Google公开了四项说话人分离专利,推动该技术从离线批处理转向流式处理,并引入大模型纠错。此技术旨在解决转写中“谁在何时说话”的难...
-
“我1%的工程师消耗了40%的token”:Coder与SpaceXAI为何要给开发者提供更好的工具
Coder推出Agent Relay服务,与SpaceXAI合作,使软件团队能在自有基础设施上运行编码代理,而Cursor负责云端推理。该方案针对银行、国...
-
英伟达买下Hugging Face的真正算盘
英伟达买下Hugging Face的真正算盘 英伟达为什么用129.3亿美金收购Hugging Face?这期从129303的Unicode表情与英伟达...
-
2026-09-06-前端与AI技术周报
本期覆盖 Electron 44.2、Bun 1.4、Vite 8.3 beta、Cursor 自托管机器与 Chrome 单轴滚动容器测试。
-
2026 09 06 HackerNews
Anthropic团队利用Claude AI在11天内完成了费马大定理的完整计算机验证,生成了1300万行Lean代码,证明了29500个中间定理,展示了...
-
推理服务的缓存与调度:前缀、多级存储、集群路由
本文讨论长上下文推理服务的缓存与调度优化。核心原则是缓存未命中比命中贵几个数量级,因此设计围绕复用展开:单实例内通过块哈希实现前缀缓存;KV池采用writ...