➡️
继续阅读
-
早报|苹果将迎来史上最大产品发布潮/微信小微内测Agent间沟通/何庭波发布「韬定律」新论文
苹果将迎来史上最大产品发布潮,包括折叠屏iPhone和iPhone 18 Pro;GPT-6 Astra全量发布;Anthropic用Claude完成费马...
-
AI代理评估是产品的一部分
该文讨论AI代理(Agent)的评估问题。文章指出,演示成功不代表系统可靠,需将评估纳入交付流程。建议建立可重复的评估系统,使用固定场景和真实任务,记录完...
-
我们花了一周时间测试IFA上最棒(也最奇特)的科技产品,欢迎提问
IFA 2026柏林展会上,The Verge编辑测试了众多科技产品,涵盖智能家居、手机、手表等。他们正为订阅者举办问答活动,解答关于飞利浦Hue灯、Eu...
-
Instagram的AI检测系统再次陷入混乱
Instagram的AI标签系统误将用户原创或轻微编辑的照片标记为“AI内容”,同时漏掉真正的AI生成图片。问题源于Meta对C2PA等元数据的检测不准确...
-
Kimi K3 模型结构(5):宽度维度,Stable LatentMoE
Kimi K3模型采用Stable LatentMoE作为FFN,基于NVIDIA LatentMoE改进,将输入压缩至半宽latent空间,增加RMSN...
-
Claude Fable 5.1 对比 Fable 5:在实际工作中,我无法区分它们。
Anthropic发布Claude Fable 5.1,宣称在编码和知识工作上有重大进步,基准测试得分翻倍。但作者用四个真实任务测试新旧模型,发现两者准确...