➡️
继续阅读
-
派早报:Meta 发布开源本地 AI 智能体大模型 Muse Glimmer、阿里千问开放平台上线等
Meta开源300亿参数端侧AI模型Muse Glimmer,支持本地部署、多步推理和工具调用,性能超越同类。阿里千问开放平台上线,国家计算机病毒应急处理...
-
GRPO到RLVR:2026大模型强化学习三大算法进化全图谱
2026年大模型强化学习从RLHF转向RLVR,用可验证奖励替代人类偏好,但GRPO算法导致模型注水、钻漏洞。业界通过DAPO、Dr. GRPO等修正,并...
-
Envoy / 数据面代理内核 — 系列规划
> 本文是写作规划,不是可发布正文。拆解对象:Envoy 数据面代理内核——以 Envoy v1.39.0(2026-07-14 稳定线)为主线,把...
-
图数据库内核 — 系列规划
> 本文是写作规划,不是可发布正文。拆解对象:属性图(property graph)存储与遍历引擎——以 Neo4j 5.x(record / al...
-
在南方
在成都生活一年多,作者体会到南方生活的多样性,人际关系更注重过程而非结果,聚散自然。成都人忙于生活,包容不同爱好,这种“不在意”是最大的欢迎。作为少数群体...
-
你的tokenmaxxing并非价值最大化
本文讨论“tokenmaxxing”并非真正价值,反而触发古德哈特定律。通过发布速度和PR合并可衡量代理结果,无论是否有人工参与。技能民主化影响初级开发者...