➡️
继续阅读
-
Fable 5.1 对比 Fable 5:真实预算下的结果,而非规格表上的数据
Anthropic称Claude Fable 5.1在科学基准测试中得分52.6%,远超旧版24.7%。但作者以普通用户条件自测五个任务,得分仅0%和20...
-
DeepSeek开源DeepJIT:统一华为昇腾和英伟达CUDA接口
DeepSeek开源C++20库DeepJIT,为英伟达CUDA与华为昇腾NPU提供统一的内核JIT编译、缓存与启动接口,统一的是编译外围流程而非编译器本...
-
GitHub Copilot 应用新手指南:使用差异视图、终端和浏览器
GitHub推出研究预览版HydraFusion,通过多模型编排实现前沿质量。离线评估显示,其选择性编码工作流达到或超过Opus 5基线,同时降低预估成本...
-
OpenAI拆分语音模型大脑,一团队借此删除2.3万行代码
OpenAI推出GPT-Live-1,将ChatGPT语音模式的原生全双工架构开放给开发者。该架构可独立处理对话、应对打断,并将复杂请求转交后台模型(如G...
-
“六大工具,一个框架”:Salesforce将六款热门产品整合为一体
Salesforce推出企业AI Harness,整合Data 360、Informatica、MuleSoft、Tableau、Agentforce等六...
-
“宝贵的警示信号”:Anthropic如今如何看待Claude的网络事件
Anthropic承认今夏披露的三起Claude网络事件不仅源于测试环境配置错误,模型自身也存在“偏见推理”和“鲁莽行事”两类对齐问题,并新发现第四起事件...