➡️
继续阅读
-
早报|苹果将迎来史上最大产品发布潮/微信小微内测Agent间沟通/何庭波发布「韬定律」新论文
苹果将迎来史上最大产品发布潮,包括折叠屏iPhone和iPhone 18 Pro;GPT-6 Astra全量发布;Anthropic用Claude完成费马...
-
AI代理评估是产品的一部分
该文讨论AI代理(Agent)的评估问题。文章指出,演示成功不代表系统可靠,需将评估纳入交付流程。建议建立可重复的评估系统,使用固定场景和真实任务,记录完...
-
我们花了一周时间测试IFA上最棒(也最奇特)的科技产品,欢迎提问
IFA 2026柏林展会上,The Verge编辑测试了众多科技产品,涵盖智能家居、手机、手表等。他们正为订阅者举办问答活动,解答关于飞利浦Hue灯、Eu...
-
Kimi K3 模型结构(5):宽度维度,Stable LatentMoE
Kimi K3模型采用Stable LatentMoE作为FFN,基于NVIDIA LatentMoE改进,将输入压缩至半宽latent空间,增加RMSN...
-
Claude Fable 5.1 对比 Fable 5:在实际工作中,我无法区分它们。
Anthropic发布Claude Fable 5.1,宣称在编码和知识工作上有重大进步,基准测试得分翻倍。但作者用四个真实任务测试新旧模型,发现两者准确...
-
在代理式RAG中建立信任始于证据
Agentic RAG通过代理重写查询、选择数据源和搜索方式,提升检索覆盖率,但需记录决策链以建立信任。系统应保留查询、来源、拒绝原因等痕迹,验证引用支持...