➡️
继续阅读
-
GPT-6 Astra空间推理91.8分超越人类:AGI时代真的来了吗!
GPT-6 Astra在空间推理测试中以91.8分超越人类基线80分,引发AGI时代讨论。但其ARC-AGI-3成绩从官方宣称的99.9%降至62.7%,...
-
开源ThoughtDAG工作流:画布上剪一根线就能改AI答案
ThoughtDAG是一款开源、本地优先的可视化工作空间,将AI对话转化为可编辑的有向无环图。用户通过连线控制上下文,剪断线即可改变AI答案,实现精确编辑...
-
推理服务的缓存与调度:前缀、多级存储、集群路由
本文讨论长上下文推理服务的缓存与调度优化。核心原则是缓存未命中比命中贵几个数量级,因此设计围绕复用展开:单实例内通过块哈希实现前缀缓存;KV池采用writ...
-
DeepSeek采购160000颗华为AI芯片:专攻推理不碰训练
DeepSeek计划采购16万颗华为昇腾950DT芯片,用于内蒙古乌兰察布数据中心的推理任务,而非训练,订单约25.6亿美元。此举旨在降低成本、规避美国管...
-
定时任务内容工作流:按计划生成、复核与发布
本文介绍Studio定时任务工作流,强调按计划生成、复核与发布内容。需配置允许列表、先手动验证再设计划、定期检查运行结果,并注意不适合无人值守的场景。任务...
-
Claude Fable 5.1 对比 Fable 5:在实际工作中,我无法区分它们。
Anthropic发布Claude Fable 5.1,宣称在编码和知识工作上有重大进步,基准测试得分翻倍。但作者用四个真实任务测试新旧模型,发现两者准确...