➡️
继续阅读
-
GPT-6 Astra空间推理91.8分超越人类:AGI时代真的来了吗!
GPT-6 Astra在空间推理测试中以91.8分超越人类基线80分,引发AGI时代讨论。但其ARC-AGI-3成绩从官方宣称的99.9%降至62.7%,...
-
Facet-0——用价值引导的RL教会VLA精密装配:通过“动作–力觉”的联合预测,让接触可预测、可估值(接触成了动作的后果,价值来定接触那一瞬怎么下手)
Facet-0是一种面向高精度接触操作的机器人基础模型,结合视觉-语言骨干与流匹配动作专家,联合预测动作及未来腕部扭矩,将接触视为可预测结果。基于Manu...
-
推理服务的缓存与调度:前缀、多级存储、集群路由
本文讨论长上下文推理服务的缓存与调度优化。核心原则是缓存未命中比命中贵几个数量级,因此设计围绕复用展开:单实例内通过块哈希实现前缀缓存;KV池采用writ...
-
DeepSeek采购160000颗华为AI芯片:专攻推理不碰训练
DeepSeek计划采购16万颗华为昇腾950DT芯片,用于内蒙古乌兰察布数据中心的推理任务,而非训练,订单约25.6亿美元。此举旨在降低成本、规避美国管...
-
Kimi K3 模型结构(10):RL 与服务,状态住在哪里
本文介绍Kimi K3模型在1M上下文强化学习与线上服务中的系统设计,核心是状态管理。KV块和KDA状态通过write-back策略在GPU与DRAM池间...
-
微软面向开发者推出无干扰的特别版Windows 11 但你通过脚本也能轻松实现类似体验
微软推出面向开发者的Windows 11特别版Project Zenith,预装开发工具并优化系统以减少干扰,但要求64GB内存以运行本地AI模型。微软也...