➡️
继续阅读
-
为何DeepSeek-V4.1-Flash是令人振奋的开源模型发布
DeepSeek发布V4.1-Flash,重点在架构革新而非跑分。模型总参数552B,预填充仅激活8B、解码16B,支持百万token上下文,全局KV缓存...
-
Flint:让 skill 成为个人资产
随着模型能力提升,通用型技能逐渐被吸收,但复用性中等、模型难以自学的技能仍有价值。作者开发了Flint——本地优先的个人AI技能资产管理器,可集中收拢、去...
-
开源LoopX:长程Agent状态管理,狂跑200小时不跑偏
LoopX 是字节工程师开源的长程 Agent 控制平面,运行在 Codex、Claude Code 之上,通过独立状态层持久化目标、证据与配额,防止 A...
-
中国物理AI大突破:PhysBrain 1.5登顶全球开源榜一,空间智能与GPT-6 Astra并驾齐驱
深度机智发布物理基座模型PhysBrain 1.5,在28项基准测试中综合得分72.5,居开源模型首位,与GPT-6 Astra、Gemini 3.6 F...
-
GitHub三榜第一背后,一个“专升本”工程师的十年
涂少坤16岁辍学打工,后专升本考入重庆邮电大学,现为小红书AI工程师。他开发的画图Agent Archify登顶GitHub热榜,单日最高新增5000 S...
-
LLMs as a Judge: How to Know if Your LLM is Healthy
In this article, we are going to look at the process of LLM evaluation in detail.