2026骁龙峰会上,高通联合阶跃、无量火与江波龙,基于第六代骁龙8超级至尊版平台,将阶跃StepEdge-Omni 30B-MoE模型面向端侧深度适配优化,打造端侧智能体助手并现场演示。江波龙提供端侧AI存储方案,由iSA存储智能体与UFS 4.1芯片支持,实现模型权重高效加载,预填充吞吐超330 Token/s,较通用方案提升逾30%,解码超28 Token/s。
微软OneDrive E3 MSDN存储账号被停用,文件暂未删除。站内大量下载链接需迁移更新,已用AI扫描受影响文章并逐步处理。文件将转存至美国VPS,部分用户下载可能较慢;文章链接日期不变,每篇仅保留最新链接,旧版需求可留言,评论区临时链接不再搬迁。
Vercel Blob 取消存储库数量限制,Hobby、Pro、Enterprise 均可按需创建。创建存储库按高级操作计费:Pro 每百万次 5 美元,Hobby 计入每月 2000 次免费额度,删除免费。可按环境、租户或临时分支创建独立存储库以隔离数据与凭证。存储、操作和流量仍按用量计费,拆分数据不增加成本。
华为发布OceanStor M900 AI记忆存储,面向超大规模数据中心AI推理,提供PB级全共享记忆空间。单集群容量64PB,KV Cache从GB级提升至TB级,时延降至60μs,带宽40TB/s,推理吞吐翻倍、首Token时延减半,并采用KV-Aware技术延长SSD寿命。
群晖在武汉工业AI论坛分享制造业数据方案,针对数据杂乱、性能成本矛盾、AI存储管控难三大痛点,构建边缘与中心协同的产线存储架构,支持多协议统一归集和AI语义搜索,实现亿级数据秒级调取;并以全闪存架构支撑研发仿真,PAS7700提供亚毫秒延迟、200万IOPS,降低存储成本。
Kubernetes v1.37 引入两项存储安全 Alpha 特性:卷挂载可设置 noexec、nosuid、nodev,防止在可写卷中执行任意二进制文件;emptyDir 支持 mode(如 01777 粘滞位限制跨容器删除文件,或 0750 限制访问)。需启用相应特性门控。
在PostgreSQL中存储金额,推荐使用numeric(14,2)等显式精度类型,精确且可直接用于报表;若金额仅累加并往返支付系统,可用bigint整数分,更快但有上限且SQL除法截断。避免real/double和money类型。作者自家记账产品用numeric多精度,计费层用整数分。可用查询审计现有schema。
陶哲轩等25位菲尔兹奖得主联名警告,AI公司把攻克数学难题当作模型评测基准,可能冲击数学研究与知识传承。其他科技动态:苹果CEO回应折叠屏迟到,称不赶时间做半成品;微软计划2032年将数据中心扩至38GW以上;九部门发布新能源汽车“十五五”规划,2030年自动驾驶将规模应用。
OpenAI自研在线存储平台Habitat,每秒处理超7000万请求,服务超10亿用户,数据量超500PB。它最初是Python客户端库,2025年因多产品协调困难转为独立服务,集中管理部署、安全与可观测性。团队用Python应对超高速增长,通过监控asyncio延迟、修复连接池LIFO导致的亚稳态故障、用Envoy汇聚连接来优化性能。最终用Rust重写,CPU效率提升6倍,内存效率提升15倍。
SQL数据类型定义数据库列可存储的值及存储空间,影响数据完整性、存储效率和查询性能。主要分为数值、字符、日期时间和二进制四类,各数据库实现略有差异。选择最小且安全的类型可优化性能,如DECIMAL用于财务精确计算,VARCHAR节省空间,TIMESTAMP记录精确时间,BINARY存储固定长度数据。正确选型能提升可扩展性并避免错误。
本文介绍Phorge文件存储服务现代化改造,核心是将文件存储迁移至单仓,新增独立二进制、三个存储后端及路由。改造重点包括直接传输二进制而非base64、保留8MB分块限制、按优先级选择后端、处理存量handle格式、解决首次启动依赖死锁。强调配置合法不等于文件真正落入预期后端,需显式切换并保护存量数据可达性。
本文讨论长上下文推理服务的缓存与调度优化。核心原则是缓存未命中比命中贵几个数量级,因此设计围绕复用展开:单实例内通过块哈希实现前缀缓存;KV池采用write-back策略在GPU、DRAM、SSD间分层存储;集群层面用一致性哈希实现缓存亲和,并按请求类别分配预算以应对长请求突发。
AI行业存储需求推动磁带存储销量增长,2026年第一季度LTO磁带出货容量同比增长57%。磁带因成本低、适合低频访问和长期存储,并能物理隔离防勒索软件,成为AI公司训练数据、历史模型和冷数据的理想冷存储层,需求持续扩大。
三星半导体在ODX 2026大会上展示面向AI基础设施的创新存储方案,包括PCIe Gen6 SSD PM1763和高容量QLC SSD BM1773,并推出zNAND-O 3D技术以缓解DRAM成本压力。公司还荣获多项年度奖项,彰显其在AI存储领域的领先地位。
Cloudflare实习生Aashi Patel开发了Cache Transcoding系统,利用Zstandard压缩算法在Pingora中编码缓存资产,将可压缩文本平均缩小至原大小的三分之一。该系统以少量CPU开销换取存储和带宽节省,测试中处理了超百万请求,验证了架构可行性,未来将优化压缩级别和参数。
Kubernetes v1.37中,存储版本迁移(SVM)功能正式GA,内置API和控制器默认启用。用户可通过创建StorageVersionMigration对象,自动将资源迁移至当前存储版本,解决CRD版本升级或加密密钥轮换时的旧数据重写问题。迁移状态可监控,成功后更新CRD的storedVersions,简化操作并提升可靠性。
本文介绍EKS上GPU工作负载的架构实践,涵盖计算节点、网络邻近性和高性能存储三层。重点包括:EFA多网卡配置(含p6-b300特殊拓扑)、四种定价模式、基于AWS原生拓扑标签的调度、FSx for Lustre与S3 Express One Zone存储选型,以及Terraform模块实现,旨在提升分布式训练性能。
Vercel调整了Sandbox快照存储的计费方式,改为按每日平均使用量计算费用,并计入月度账单。此前是按整个账单周期的平均值计费。费率仍为每GB每月0.08美元,仅计算方式变化。Pro和企业团队将在下个账单周期自动生效,无需操作,可在Usage页面查看每日费用。
本文介绍AOTInductor(PyTorch编译器后端)如何将模型权重存储在共享库外,并在推理时线程安全地更新权重。通过设置`package_constants_in_so`为False、`freezing`为False及`always_keep_tensor_constants`为True,权重可外部保存。C++端使用`load_constants`加载权重到非活动缓冲区,再通过`swap_constant_buffer`和`free_inactive_constant_buffer`实现双缓冲安全交换,支持热更新,避免GPU内存峰值。
本文介绍了四个Rust相关项目:Celeriant分布式事件存储数据库,用Rust实现每秒百万次写入;Termixel终端像素画渲染器;cs2excel CS2库存估值工具;以及Rust RFC #3943关于复用移动后变量存储空间的提案。
完成下面两步后,将自动完成登录并继续当前操作。