➡️
继续阅读
-
AI代理评估是产品的一部分
该文讨论AI代理(Agent)的评估问题。文章指出,演示成功不代表系统可靠,需将评估纳入交付流程。建议建立可重复的评估系统,使用固定场景和真实任务,记录完...
-
早报|苹果将迎来史上最大产品发布潮/微信小微内测Agent间沟通/何庭波发布「韬定律」新论文
苹果将迎来史上最大产品发布潮,包括折叠屏iPhone和iPhone 18 Pro;GPT-6 Astra全量发布;Anthropic用Claude完成费马...
-
AI 智创简报:《Agent 记忆层被写进专利,垂直行业的本地化长尾还空着》
微软与UiPath近期公开了四项Agent记忆与跨上下文专利,涵盖共享上下文、事件流路由及三级记忆体系,显示大厂正抢占记忆层基础设施。尽管开源组件热门,但...
-
AI 智创简报:《逐句举证专利扎堆,RAG 质检的插件生意》
2026年多家大厂专利显示,AI答案需逐句带证据,可验证性从事后打分前移至生成时内嵌。第三方质检工具空缺,为客服、法务等团队提供引用质检插件或审计服务,成...
-
“对混乱的发布感到抱歉”:OpenAI推出GPT-6 Astra,但开发者被拒之门外
OpenAI发布GPT-6 Astra,但发布过程混乱,CEO Sam Altman道歉。API和ChatGPT订阅用户尚未获得广泛访问权限,预计先从Pr...
-
从AI代码到可信软件:工程约束的实践
文章探讨了“工程约束”如何通过仓库强制执行标准,确保AI生成代码的质量与问责。它强调权限、质量门、证据和可观测性,并描述了从辅助到自主的成熟度阶段。核心是...