小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
英特尔CEO暗示重返内存制造市场 甚至还重新考虑将内存与CPU堆叠(不可更换内存)

英特尔CEO陈立武表示,因AI数据中心内存需求巨大,公司正考虑重返存储器市场,并探索内存与CPU堆叠封装技术。英特尔曾以DRAM起家,后因竞争退出。2024年月亮湖处理器曾尝试堆叠内存,但因OEM抵制而放弃。若自产内存封装,或具价格优势。

英特尔CEO暗示重返内存制造市场 甚至还重新考虑将内存与CPU堆叠(不可更换内存)

蓝点网 蓝点网 · 2026-08-13T02:00:22Z

该文章介绍了一个名为“Awesome C++ Blogs”的精选技术博客集合,旨在系统整理值得反复阅读的C++相关文章,类似必读书目。目前内容初步规划,已列出百度C++工程师的极限优化系列,涵盖内存和并发两个主题,后续将逐步补充更多内容。

Awesome C++ Blogs

编程沉思录 编程沉思录 · 2026-08-12T19:00:00Z
TAG Video Systems 优化内存使用,降低总体拥有成本

TAG Video Systems通过优化内存使用,在压缩视频工作流中实现每通道成本降低66%,服务器容量仅下降20%。该方案已扩展至ST 2110环境,内存节省显著但容量减半。研发副总裁强调,通过重新设计而非转嫁内存涨价成本,提供同等质量的低价方案。新MCM软件包含此优化,客户可免费获取。

TAG Video Systems 优化内存使用,降低总体拥有成本

实时互动网 实时互动网 · 2026-08-11T06:16:06Z
群晖推出价格更低的NEO系列机型 与传统机型相比主要区别就是将内存换成非ECC

群晖推出更便宜的NEO系列NAS,采用非ECC内存以降低成本,应对内存价格上涨。硬件与PLUS系列相同,用户可自行更换ECC内存,价格便宜7%至36%。

群晖推出价格更低的NEO系列机型 与传统机型相比主要区别就是将内存换成非ECC

蓝点网 蓝点网 · 2026-08-11T01:30:51Z
都怪WebView框架:Windows 11天气应用打开会占用1GB的内存

Windows 11天气应用因使用WebView2框架,启动时占用约1GB内存,交互或渲染动态画面时可达1.5GB,主要因加载广告和资讯模块所致。在8GB内存设备上成为负担,建议微软转向原生应用以优化内存效率。

都怪WebView框架:Windows 11天气应用打开会占用1GB的内存

蓝点网 蓝点网 · 2026-08-10T05:27:38Z

本文介绍了四个Rust项目:RSMalloc内存分配器基于RSEQ,优化多尺寸管理;synology-dedup-photos用dHash和CLIP去重照片;Sift文件整理器支持事务日志回滚;zaytun-os实验性Wayland桌面由合成器统一驱动动画,提升流畅性。

【Rust日报】2026-08-10 RSMalloc Alpha-2 发布:Rust 内存分配器的新版本

Rust.cc Rust.cc · 2026-08-10T01:06:11Z
数据库写入持久性层级揭秘:内存、本地SSD、对象存储与三副本

数据库写入速度的“成功”定义决定数据安全:内存写入最快但断电即失,本地SSD需刷盘但丢主机风险高,对象存储慢但更稳,三副本最慢但最可靠。性能与可靠性是权衡,低延迟常以数据丢失风险为代价,选型时需细查“成功”标准。

数据库写入持久性层级揭秘:内存、本地SSD、对象存储与三副本

极道 极道 · 2026-08-10T00:40:00Z

本文介绍Neo4j图数据库生产环境排障方法,核心是“三轴分流”:先判断慢查询属于计划基数(轴A)、存储I/O(轴B)还是锁/并发(轴C),再对症处理。文章强调超节点问题应优先优化建模与查询而非硬件,并给出内存三分(page cache、heap、OS)的配置与指标解读,以及锁死锁排查、慢查询固定流程和症状速查表。

【图数据库内核】生产排障:超节点、爆炸路径、内存三分与慢查询清单

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-08-09T00:00:00Z
新内存战争

苹果在内存采购压价遭长鑫拒绝,因存储芯片供需失衡,涨价潮持续至2028年。三星发布400+层NAND和zHBM概念,SK海力士推HBF规范,均瞄准高端市场。长鑫LPDDR6送样,获PC厂采购,但增产难改涨价趋势。消费电子面临涨价压力,普通消费者只能承受。

新内存战争

爱范儿 爱范儿 · 2026-08-06T08:51:34Z
消息称苹果急缺内存 A20系列芯片已经量产 但缺少内存无法封装

苹果面临移动DRAM内存芯片短缺,台积电已量产A20 Pro芯片但缺内存无法封装,可能影响9月新机发布备货。AI服务器需求抢占内存产能,导致手机、PC等电子产品涨价,短期内供需失衡难缓解。

消息称苹果急缺内存 A20系列芯片已经量产 但缺少内存无法封装

蓝点网 蓝点网 · 2026-08-06T08:34:05Z
英特尔傲腾生错时代?铠侠展示内存扩展模块XL1 用存储级闪存补充内存

铠侠推出XL1内存扩展模块,面向AI数据中心,基于XL-FLASH闪存,通过CXL接口连接服务器内存。该模块介于DRAM与NVMe SSD之间,将低频访问数据从内存移至模块,提升效率并降低成本。与英特尔傲腾类似,但采用闪存技术路线,依赖CXL生态,本月起向合作伙伴出货样品。

英特尔傲腾生错时代?铠侠展示内存扩展模块XL1 用存储级闪存补充内存

蓝点网 蓝点网 · 2026-08-06T07:36:02Z
8GB 内存也能跑 Kimi K3?2026 本地部署大模型配置全指南

2026年本地部署大模型趋势显示,万亿参数模型如Kimi K3可通过流式加载在8GB内存CPU上运行,但速度极慢。部署关键取决于显存容量和内存带宽,8GB适合小模型,80GB以上可运行120B模型。DeepSeek V4 Flash经量化可在128GB内存设备运行。工具选择上,LM Studio适合新手,Ollama适合开发者,llama.cpp提供精细控制。本地部署需权衡成本、速度与隐私。

8GB 内存也能跑 Kimi K3?2026 本地部署大模型配置全指南

爱范儿 爱范儿 · 2026-08-05T06:23:46Z
Qdrant 1.19 - TurboQuant数据类型与内存层级

Qdrant 1.19发布,主要新功能包括:TurboQuant数据类型将向量压缩至4位,存储减少九倍;统一内存层级配置(固定、缓存、冷);支持按租户计算IDF统计;新增关键词前缀匹配和切片过滤;Web UI增强,支持实时分片进度、大规模可视化及索引管理。另有资源配额、副本读取亲和性等改进。

Qdrant 1.19 - TurboQuant数据类型与内存层级

Qdrant - Vector Database Qdrant - Vector Database · 2026-08-05T01:00:00Z
为什么大语言模型的内存成本高昂以及如何解决

LLM长上下文推理成本高,主因是KV缓存随token数线性增长,解码时需逐token读取全部缓存,受内存带宽限制。优化方法包括:分组查询注意力、潜在注意力减少每token存储;量化降低存储精度;驱逐机制减少token数;分页注意力和前缀缓存提升内存管理效率。各方法在质量、工程复杂度间权衡,适合长上下文和高并发场景。

为什么大语言模型的内存成本高昂以及如何解决

ByteByteGo Newsletter ByteByteGo Newsletter · 2026-08-04T15:31:00Z
随着AI对内存需求的增加,存储技术迎头赶上

在FMS大会上,NVIDIA展示了AI对存储的新需求,推出开源cuFile API,使GPU能直接高速访问存储。同时,NVIDIA联合40多家厂商发起Storage-Next计划,通过SCADA框架实现安全、高效的GPU直连存储,提升AI数据处理性能,满足AI工厂对大规模数据的需求。

随着AI对内存需求的增加,存储技术迎头赶上

NVIDIA Blog NVIDIA Blog · 2026-08-04T15:00:47Z
开发者在8GB内存上部署Kimi K3模型并成功运行 只是...速度为33秒/Token

开发者用C99编写推理引擎,在无GPU、仅8.24GB内存的CPU上成功运行Kimi K3模型,速度33秒/Token;内存增至128GB时提速至20秒/Token,但已达上限。该引擎按需从NVMe读取专家权重,采用4-bit格式,验证了超大规模模型在低内存设备上的可行性,并已开源。

开发者在8GB内存上部署Kimi K3模型并成功运行 只是...速度为33秒/Token

蓝点网 蓝点网 · 2026-08-03T04:00:53Z
微软首次明确将8GB内存作为优化目标 要优化Windows 11在8GB内存的使用体验

微软首次明确将8GB内存设备作为Windows 11优化目标,因内存价格高,OEM被迫预装8GB内存,但系统运行卡顿。微软计划减少内存占用,提升响应速度,确保8GB设备能正常使用,以应对销量问题。

微软首次明确将8GB内存作为优化目标 要优化Windows 11在8GB内存的使用体验

蓝点网 蓝点网 · 2026-08-01T06:35:20Z
Kimi K3技术报告解析:选择性遗忘如何破解大模型内存墙

Kimi K3通过“选择性遗忘”机制,以固定大小记忆替代无限增长的KV缓存,降低75%内存并提速6倍,以2.8万亿参数实现开源模型顶尖性能。其KDA技术混合压缩与遗忘,兼顾效率与精确回忆,成本降至每百万token 0.3美元,但长距离细节检索仍有局限。

Kimi K3技术报告解析:选择性遗忘如何破解大模型内存墙

极道 极道 · 2026-07-31T22:13:00Z
不要过早停止:以内存速度进行源代码大小写折叠

Dependabot默认频繁创建拉取请求,造成仓库噪音。本文介绍通过分组更新和降低更新频率,同时保持安全修复快速,以减少干扰。该方法已在微软开源项目中应用,有效平衡依赖维护与开发效率。

不要过早停止:以内存速度进行源代码大小写折叠

The GitHub Blog The GitHub Blog · 2026-07-31T16:00:00Z
Percona Server for MySQL中存储过程的内存消耗

本文介绍从MySQL Galera Cluster迁移至Percona XtraDB Cluster的步骤、兼容性考量及操作要点,旨在帮助用户平滑过渡并利用Percona的增强功能。

Percona Server for MySQL中存储过程的内存消耗

Percona Database Performance Blog Percona Database Performance Blog · 2026-07-31T11:50:51Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码