DeepSeek、千问、智谱轮番登场,PC 厂商终于等到了它们的弹药

DeepSeek、千问、智谱轮番登场,PC 厂商终于等到了它们的弹药

💡 原文中文,约4000字,阅读约需10分钟。
📝

内容提要

AMD在IFA 2026发布Personal AI战略,推出Ryzen AI Max 400、HP ZBook及Threadripper Halo Station,支持本地运行大模型。强调本地计算、隐私与个人上下文,以降低AI成本。开源模型如GLM、Qwen可本地运行,性能优于云端,推动AI从云端转向个人设备。

🔎

延伸解读

本地运行大模型的成本优势

文章指出,云端运行大模型的成本高昂,例如一个活跃用户每天消耗1500万输出token,走云端约需300欧元一天,一年接近10万欧元。而本地运行则无需按token计费,例如Laguna S 2.1在Strix Halo上运行,1000万输出token的成本为零。这凸显了本地AI在成本控制上的巨大潜力,尤其对于高频使用AI的用户或企业,能显著降低运营开支。

开源模型成为硬件厂商的“弹药”

AMD在演讲中展示了DeepSeek、千问、GLM等开源模型在自家硬件上的运行效果,并强调本地模型性能已能媲美甚至超越云端闭源模型,如GLM-5.3-Flash在Gorgon Halo上表现优于Claude Fable 5。开源模型的小型化和高性能,为PC厂商提供了证明本地算力价值的工具,成为推动PC更新换代的关键因素。

个人AI的隐私与上下文优势

AMD强调个人AI的三大关键词:本地计算、隐私与控制、个人上下文。本地处理敏感数据可减少云端传输风险,用户能自主决定哪些数据离开设备。同时,本地模型能结合个人上下文(如日程、文件)提供更个性化的服务,例如“帮我准备明天”会因用户身份不同而给出不同响应,这是云端通用模型难以实现的。

生态合作与软件适配是关键

硬件能装下大模型,但Agent要安全运行还需操作系统和软件生态支持。微软正为统一内存访问和工作负载调度做适配,并推出Microsoft Execution Containers隔离Agent执行环境,以及Project Zenith为开发者提供开箱即用体验。这些合作表明,个人AI的落地不仅靠芯片,还需软硬件协同,才能让用户真正用起来。

Q&A

AMD在IFA 2026上发布的Personal AI战略是什么?

AMD的Personal AI战略是将AI计算从云端拉回本地,让电脑优先处理本地任务,涉及敏感数据和个人上下文的任务尽量留在本地,需要更大规模时再调用云端。其核心理念包括本地计算、隐私与控制、个人上下文。

AMD在IFA 2026上发布了哪些新产品?

AMD发布了三款新品:Ryzen AI Max 400(代号Gorgon Halo)平台、下一代HP ZBook笔记本(代号Sundance)以及Threadripper Halo Station工作站。

为什么AMD认为需要将AI从云端转移到本地?

因为云端AI成本高昂,例如一个活跃用户每天1500万输出token,走云端约300欧元一天,一年接近10万欧元。同时93%的企业正在超支AI预算。本地计算可以降低成本,同时提供更好的隐私保护和个人上下文。

AMD的Ryzen AI Max 400系列(Gorgon Halo)支持多大的模型?

Ryzen AI Max 400系列统一内存从128GB提升到192GB,本地可运行模型从2000亿参数提升到3000亿参数,现场展示了智谱的GLM-5.3-Flash(3200亿参数)可以本地运行。

Threadripper Halo Station有什么特点?

Threadripper Halo Station是AMD发布的桌边工作站,配备96核Threadripper PRO处理器和数据中心级AMD Instinct MI350P显卡,支持最高2TB系统内存,四卡配置下HBM3E总容量最高576GB,采用液冷,可运行超过1万亿参数的模型,被称为“全球最强工作站”。

微软在AMD的Personal AI生态中扮演什么角色?

微软与AMD合作,为Personal AI提供软件支持。Windows正在为统一内存访问和工作负载调度做适配,让大模型能使用Gorgon Halo的内存与GPU。微软还公布了Microsoft Execution Containers为Agent提供隔离执行环境,以及Project Zenith为开发者级硬件提供开箱即用的Windows体验。

开源模型在AMD的Personal AI战略中起到什么作用?

开源模型如DeepSeek、千问、GLM等成为AMD展示本地算力价值的“弹药”,它们可以本地运行且性能优于云端模型,例如Laguna S 2.1在软件工程基准上超过Claude Sonnet 5。开源模型帮助硬件公司证明本地算力有价值,同时借助新硬件扩大影响力。

🏷️

标签

➡️

继续阅读