➡️
继续阅读
-
应对社会最复杂挑战的计算工具
MIT副教授Cathy Wu利用强化学习优化交通等复杂系统。受父亲通勤和游戏启发,她于2018年成功用RL分析自动驾驶对交通流的影响,但随后研究受挫。20...
-
知识库的结构:素材、流程、案例三分
该文本仅为付费阅读和登录提示,无实质文章内容,无法总结。
-
通过微扰分析求解等式约束优化问题
对于无约束的光滑函数来说,求极值的通用方法自然是求导(梯度)并让导数等于零了。那带等式约束的极值问题呢?很多读者应该也不陌生,标准方法是拉格朗日乘子法。然...
-
给博客做个站内全文搜索:纯前端离线倒排索引的设计与取舍
作者为Hugo博客开发了纯前端离线全文搜索方案:构建时用Python和jieba生成倒排索引,拆分为核心与正文两层并按需异步加载;倒排表采用Base-32...
-
DeepSeek-V4.1 模型结构(8):KV cache 的管理与 SWA Bounded Replay
DeepSeek-V4.1为降低长上下文agent负载成本,将滑窗KV从SSD移至主机内存池,仅保留几分钟;全局KV仍存SSD至少72小时。滑窗KV丢失后...
-
DeepSeek-V4.1 模型结构(7):输入端与优化器
DeepSeek-V4.1在主干外有两处改动。视觉端:自研DeepSeek-ViT从零训练,采用2D-RoPE、RMSNorm、SwiGLU,经3×3 p...