➡️
继续阅读
-
一分钟读论文:《数据喂饱了,算法还饿着》
清华大学团队研究发现,在线蒸馏中仅用一条训练query即可覆盖全量数据71.5%的学生状态,恢复大部分收益。瓶颈不在数据供给,而在算法吸收效率。多教师设定...
-
让炼丹更科学一些(九):经典自适应梯度算法
本系列前面八篇文章,都是在围绕SGD及其学习率讨论。而从本文开始,我们将正式进入自适应梯度算法的世界。可以说,现在所有的自适应梯度算法,都有一个共同的源头...
-
从AI代码到可信软件:工程约束的实践
文章探讨了“工程约束”如何通过仓库强制执行标准,确保AI生成代码的质量与问责。它强调权限、质量门、证据和可观测性,并描述了从辅助到自主的成熟度阶段。核心是...
-
AI原生工程实践:AI工程师与前沿部署工程师如何利用Claude Code、Codex和Gemini进行开发
本文介绍AI原生软件开发生命周期(SDLC)框架,涵盖计划、设计、构建、测试、部署、维护六阶段。核心是通过意图、规格、计划等文档驱动开发,将瓶颈从编码转向...
-
NuGet 半年度总结:周下载量从 54 亿到 67 亿,.NET 生态的"新一轮增长期"实锤了 - 张善友
NuGet周下载量半年净增13亿次达67亿,印证.NET 10 LTS与AI开发共振。OpenTelemetry首入TOP10,.NET 10工作负载包上...
-
一次相差 2378 倍的 SQLx 查询:TeaQL 如何把业务边界变成执行计划
该文通过MusicBrainz数据集测试,对比SQLx与TeaQL查询性能。直观SQLx全局窗口查询耗时5871毫秒,而先选根对象的两阶段查询仅2.5毫秒...