这届 AI PC,太烧心了

这届 AI PC,太烧心了

💡 原文中文,约3600字,阅读约需9分钟。
📝

内容提要

AI服务器挤占内存产能,导致内存与SSD价格暴涨,PC物料成本占比升至近40%,2026年第三季度全球PC出货量同比大跌约20%。厂商被迫涨价、降配或延长旧平台寿命,技嘉让DDR4主板支持新处理器。同时开源项目Strata用消费级显卡本地运行千亿参数大模型,显示软件挖潜可降低智能门槛。

🔎

延伸解读

内存涨价如何传导至PC售价

AI服务器对HBM和服务器DRAM的需求增长,挤压了消费级内存的产能,导致内存与SSD价格持续攀升。Omdia数据显示,存储部件在PC物料成本中的占比已从约15%升至接近40%。TrendForce以900美元笔记本测算,CPU、DRAM和SSD合计占物料成本约68%。成本压力下,厂商多次提价仍难填平缺口,消费者则转向延长旧电脑使用周期。

出货量下滑背后的多重因素

IDC初步数据显示,2026年第三季度全球PC出货量同比下降20.1%,从7850万台降至6270万台。Omdia统计也显示同比下降21.2%。但下滑并非全由涨价导致:去年同期因Windows 10停止支持带来的换机需求推高了基数,且上半年渠道为规避内存涨价而提前备货,透支了下半年需求。库存压力可能促使促销,但价格难以回到一年前水平。

厂商的应对策略与用户选择

面对成本压力,厂商选择涨价、自行消化成本、降低配置或延长成熟平台寿命。技嘉宣布B760和H610主板通过BIOS更新支持2027年初的新英特尔处理器,包括DDR4主板;AMD平台也有AM4主板配合Ryzen 7 5800X3D重新推出。DDR4与DDR5价差显著,The Verge记者发现32GB DDR5套装售价620美元,而DDR4仅260美元,对于已有DDR4内存的用户,保留旧内存可节省升级费用。

软件挖潜降低本地AI门槛

开源项目Strata让消费级电脑本地运行1250亿参数的Qwen3.8-Flash-Next模型。在RTX 5070、12GB显存、Ryzen 5 7600和64GB内存的配置下,Q2_0量化版本生成速度达每秒94 Token,IQ3_S版本为每秒53 Token。其利用MoE架构的稀疏性,将高频专家缓存在显存,全部专家权重放在系统内存,CPU并行处理未缓存专家,SSD存放查找表,并采用推测解码加速。但低比特量化会损失精度,且32GB内存通常只能运行能力较弱的Coder版本。

❓

Q&A

为什么最近PC内存和SSD价格暴涨?

因为AI服务器对HBM和服务器DRAM的需求持续增长,存储厂商将更多资源投向利润更高的数据中心产品,导致消费级内存产能增长空间被挤压,价格随之上涨。

2026年第三季度全球PC出货量下降了多少?

IDC初步数据显示,2026年第三季度全球PC出货量同比下降20.1%,从去年同期的7850万台缩水至6270万台。Omdia统计也显示同比下降21.2%。

PC厂商如何应对内存涨价带来的成本压力?

厂商主要采取三种策略:继续涨价、自己扛下部分成本,或者降低配置、延长成熟平台的服役期。例如技嘉让DDR4主板通过BIOS更新支持新处理器,AMD也推出新AM4主板。

技嘉对旧主板提供了什么新支持?

技嘉宣布旗下全部B760和H610主板将通过BIOS更新,支持预计2027年初推出的新款英特尔LGA1700处理器,包括DDR4主板。此外,技嘉还于今年8月宣布新一批AM4主板,配合Ryzen 7 5800X3D的重新推出。

Strata项目是什么?它有什么亮点?

Strata是一个开源项目,在GitHub上获得约1.95万颗Star。它能让普通游戏电脑本地运行千亿参数大模型,例如在RTX 5070、12GB显存、Ryzen 5 7600和64GB内存的电脑上,以Q2_0量化配置运行1250亿参数的Qwen3.8-Flash-Next,生成速度达每秒94 Token。

Strata如何让消费级硬件运行大模型?

Strata利用MoE架构的稀疏性,将高频专家缓存在显存,全部专家权重保存在系统内存,显卡负责核心计算,CPU并行处理未缓存的专家,SSD存放查找表。同时采用低比特量化和推测解码来加速,但量化会损失精度。

🏷️

标签

➡️

继续阅读