➡️
继续阅读
-
“OpenAI解体的开端”:OpenAI放缓模型训练——并非所有人都相信这一解释
OpenAI因模型能力增长快于安全对齐,暂停部分前沿强化学习训练两周,并加强监控,称需确保安全标准。此举引发质疑,或与财务压力有关,因OpenAI亏损扩大...
-
OpenAI踩下刹车。接下来呢?
OpenAI近期放缓部分AI开发,暂停强化学习训练两周以加强安全措施,被视为行业自律的测试。专家认为,自愿减速虽能短期提升安全性,但缺乏行业统一性和政府监...
-
闭源RSI的严父:18个Agent自主科研,Kimi K3靠Harness逼近Opus 5
Prime Intellect的研究表明,开源模型结合Multi-Agent Harness在nanoGPT优化任务中表现接近顶级闭源模型,挑战了RSI的...
-
活动回顾|从编译优化到场景应用,多视角剖析 Agent 时代的 AI Compiler 技术创新与落地经验
该文报道了一场AI编译器技术分享活动,多位专家围绕编程语言、算子优化与推理执行展开讨论。内容涵盖Triton-TLE语言扩展、TileRT低延迟推理、Fa...
-
华尔街实测8款全球主流Agent:千问办公综合排名第一
杰富瑞测试显示,阿里千问办公在八款主流AI Agent中综合得分第一,超越Claude Cowork和Codex。其优势在于模型与Harness协同,复杂...
-
Agent 评测别只看分数,先想清楚它怎么进生产
Agent评测不应仅看分数,需关注生产落地。应拆解错误环节(如任务理解、工具选择),贴近真实链路,考虑权限、审计、成本。普通团队可从小规模固定用例和失败样...