➡️
继续阅读
-
纯 .NET 手写 CUDA kernel,GLM-5.3-Flash decode 跑出 llama.cpp 的 2 倍 - 张善友
TensorSharp 是纯 .NET LLM 推理引擎,三天内接入 GLM-5.3-Flash 和 Qwen3.8-Flash-Next 新架构。它支持...
-
智谱宣布GLM-5.3模型正式开源 支持免费部署和商用 但大型企业必须先提交审查
智谱发布GLM-5.3模型,总参数743B,采用MoE架构,激活39B,支持1M窗口,强化编程、智能体及网络安全能力。模型权重免费开源可商用,但非MIT许...
-
在企业环境中为 AI 编程工具构建内容审查层
本文探讨企业为AI编程工具构建内容审查层(DLP)的方案,核心是内容审查需在明文可见处进行。路径分两种:可改端点的自研应用用LiteLLM网关,闭源工具如...
-
【Rust日报】2026-08-30 Rustdoc 一周提速 33%
Rustdoc通过先过滤再构建trait impl,并限制primitive和synthetic impl,平均提速约33%,部分crate提升40%。该...
-
【Rust日报】2026-08-30 Rustdoc 一周提速 33%
Rustdoc 通过一系列 PR 优化,平均提速约33%,部分 crate 最高达40%。改进源于先过滤再构建 trait impl,并限制 primit...
-
花坛
文章回忆了作者小学四年级时因跳越教室外花坛导致脚背骨裂的经历。作者描述了教室的昏暗环境、花坛的简陋以及班主任的严肃形象,但并未记恨花坛,反而后来在花坛玩耍...