➡️
继续阅读
-
并行策略总览:六个维度各切什么、怎么通信
本文介绍大模型并行训练的核心概念,将DP、TP、SP、PP、EP、CP六种并行方式按切分维度、显存减少、通信开销和等待关系列表对比。并行本质是切分模型并引...
-
营销人员使用Genie One的五个方法
本文介绍Databricks Genie One如何赋能营销团队,将数据转化为行动。它作为AI助手,帮助营销人员绕过分析师瓶颈,直接查询活动、客户和管道数...
-
Kubernetes v1.37:KubeletInUserNamespace(即无根模式)升级至Beta
Kubernetes v1.37将KubeletInUserNamespace特性升级至beta,允许节点组件以非root用户运行于Linux用户命名空间...
-
2026 09 06 HackerNews
2026-09-06 Hacker News Top Stories # Anthropic 团队用 Claude AI 在11天内完成了费马大...
-
推理服务的缓存与调度:前缀、多级存储、集群路由
本文讨论长上下文推理服务的缓存与调度优化。核心原则是缓存未命中比命中贵几个数量级,因此设计围绕复用展开:单实例内通过块哈希实现前缀缓存;KV池采用writ...
-
显存账本:每张卡上住着什么,搬走付什么
本文介绍训练大模型时显存管理的通用记账方法。显存分为五类:权重、梯度、优化器状态、激活和通信缓冲。前三类由参数量和并行度决定,激活随输入长度增长,优化空间...