➡️
继续阅读
-
智谱开源发布GLM-5.3-Flash模型 编程和智能体能力接近Claude Opus 4.8
智谱开源发布GLM-5.3-Flash模型,采用MoE架构,总参数320B但激活仅18B,提升响应速度并降低成本。该模型在编程和智能体能力上接近Claud...
-
世界纪录,Qwen 3.8 27B 单台 125 token
懒猫AI算力仓单台运行Qwen 3.8 27B模型,创下性能纪录:prefill速度3754 TPS,长代码解码125 TPS,八会话解码231 TPS,...
-
Token效率鄙视链被打脸:实测证明,Rust才是AI编程时代的隐藏赢家
Danluu通过Zstd解码器和Pandoc转换器两组真实工程评测,挑战了“动态语言更省Token”的观点。结果显示,在简单题目或低算力下动态语言占优,但...
-
27B AI 科学家论文复现能力超越 GPT-5.5/Claude Opus 4.8,Faraday 探索长程科学创新
论文复现是科学基石,但机器学习领域面临可复现性危机。Inherent Labs团队训练了270亿参数的AI智能体Faraday,利用Codex GPT-5...
-
那个内存泄漏一直都在,只是旧 GC 悄悄替我兜了三年 - 编程一生
一个存在三年的内存泄漏问题,在Java 8升级到11后暴露。原因是JavaCV库的堆外内存未显式释放,旧GC高频回收掩盖了泄漏,新G1 GC不频繁触发清理...
-
谷歌发布Gemini 3.5 Transcribe语音转文字模型 提升实时转写准确率和多语言能力
谷歌发布Gemini 3.5 Transcribe语音转文本模型,提升实时转写准确率、降低延迟,支持85种语言,自动去除口头语并修正表达,可区分说话者。流...