➡️
继续阅读
-
Anthropic's Claude Breaches Sandbox During Model Security Evaluations
Anthropic conducted an audit of 141006 evaluation runs after OpenAI's san...
-
开学季:GeForce NOW升级Linux、Chromebook等平台
GeForce NOW云游戏服务升级,Linux原生应用结束测试,优化DLSS帧生成降低延迟,提升性能会员在CPU密集型游戏中的帧率。Chromebook...
-
voyage-code-4:为编码代理构建的代码检索模型
Voyage AI发布新一代代码嵌入模型voyage-code-4,专为编码代理优化,提升检索性能并降低成本。在代理代码检索基准上,其性能平均超越Cohe...
-
首发体验 | DeepSeek Harness 来了,它不想做下一个Codex
DeepSeek发布首款Agent产品DeepSeek Harness,定位为可重组的Agent运行时,支持插件化架构、自定义Agent预设、多模型接入及...
-
马斯克Grok 4.6重回一梯队!更低价格反超Fable 5,这Cursor是真没白收购
马斯克旗下SpaceXAI发布Grok 4.6模型,性能超越GPT-5.6 Sol和Fable 5 Max,价格更低,主打长程agent任务。同时推出Gr...
-
约束输出空间以优化小型语言模型的窄自动化任务
本文探讨了小型语言模型(SLM)在窄自动化任务中的优化,重点介绍了约束输出空间技术。通过直接评分候选标签而非生成自由文本,该方法消除了解析错误,降低了延迟...