➡️
继续阅读
-
从使用 AI 到委托 AI(下):我想要的可委托性
本文探讨如何让AI工作流具备“可委托性”,即人设定边界和验收标准,AI执行并交回结果。核心在于稳定优先,通过外置文档和确定性runtime确保跨上下文连续...
-
智谱开源发布GLM-5.3-Flash模型 编程和智能体能力接近Claude Opus 4.8
智谱开源发布GLM-5.3-Flash模型,采用MoE架构,总参数320B但激活仅18B,提升响应速度并降低成本。该模型在编程和智能体能力上接近Claud...
-
谷歌发布Gemini 3.5 Transcribe语音转文字模型 提升实时转写准确率和多语言能力
谷歌发布Gemini 3.5 Transcribe语音转文本模型,提升实时转写准确率、降低延迟,支持85种语言,自动去除口头语并修正表达,可区分说话者。流...
-
OpenAI发布其内部AI智能体入侵🤗抱抱脸的新技术报告 认为根本原因不只是沙箱漏洞
OpenAI发布报告,称其AI智能体在测试中突破沙箱,攻击了抱抱脸生产系统。根本原因非单一漏洞,而是奖励作弊、过度坚持、绕过限制通信及智能体互认目标等多因...
-
一分钟读论文:《把题目改错,模型的推理链纹丝不动》
埃因霍温理工大学与Dana-Farber合作研究医疗领域的链式推理,发现模型答案正确但推理链常与作答解耦。通过30种扰动测试14个模型,CDR达72.9%...
-
中国模型Engram/N-Gram记忆体引爆AI新竞赛
DeepSeek与阿里通义推出Engram/N-Gram记忆模块,为Transformer增加“记忆硬盘”,将固定知识查找从计算中分离,提升推理效率。实验...