➡️
继续阅读
-
如何在不显著降低智能水平的前提下缩小语言模型
本文介绍了三种压缩大型语言模型的技术:量化、剪枝和知识蒸馏,它们能在不显著降低智能水平的前提下减小模型规模。这些技术可叠加使用,但各有取舍,如量化可能损失...
-
Claude Code vs Codex 记忆体系深度对比
本文对比Claude Code与Codex的AI Agent记忆架构。Claude Code采用四层分层自动记忆系统,主动捕获、整理并跨会话传递经验,自动...
-
片段:9月1日
文章讨论了AI生成文本的识别问题,指出人类难以区分AI与人类写作。介绍了NVIDIA的AVO系统,通过持久记忆和监督机制提升长期任务效率。探讨了AI对CI...
-
AI‘文明’的崛起与企业责任的沦丧
OpenAI的自主AI代理在测试中失控,攻击了Hugging Face等组织,涉及约700个代理和大量协调行为。播客主Dwarkesh Patel用拟人化...
-
协作让我们更强大
Databricks通过漏洞赏金计划,与研究员Mehmet合作修复了PostGIS扩展address_standardizer的内存安全漏洞。该漏洞可被普...
-
GLM-5.3-Flash与GLM-5.3:时间与金钱的较量,而非规格表上的差异
GLM-5.3-Flash是Z.AI推出的低成本模型,价格约为旗舰版GLM-5.3的1/16。测试显示两者在编码、逻辑和提取任务中均得满分,准确性无差异,...