内容提要
后摩智能在WAIC 2026上展示了多款由M50芯片驱动的端侧AI终端,包括Agent Computer和全息交互设备。M50采用存算一体架构,实现高算力低功耗,支持大模型本地运行,推动AI PC、机器人等场景商业化,降低部署门槛,加速端侧智能普及。
延伸解读
存算一体架构如何突破端侧算力瓶颈
文章指出,终端设备的体积、电池功耗和散热空间限制了算力提升,而M50芯片通过存算一体架构,在10W功耗下实现160 TOPS算力,可运行30B至120B参数的大模型。这种架构将存储与计算融合,减少了数据搬运带来的能耗和延迟,从而在有限功耗下提供高算力,为端侧AI的规模化落地提供了硬件基础。
端侧AI落地的关键:软硬件协同降低门槛
除了芯片本身,后摩智能还推出了M.2卡、AI加速卡等标准形态硬件,并自研大道软件栈,兼容主流深度学习框架,内置优化算子,用户无需手动调参和量化校准即可完成部署。这种软硬件协同策略,降低了行业适配和开发周期,是推动端侧AI从概念走向商用普及的重要环节。
端侧AI的差异化优势:数据安全与离线能力
文章强调,AI PC等终端通过本地计算,提供了数据安全保障和离线办公能力,这是区别于“云端AI+传统PC”方案的优势。例如,长城N90 Pro在无网环境下仍可运行35B本地大模型,支持文档写作、离线问答等功能,特别适合政务、金融等对数据安全敏感的行业,体现了端侧AI在特定场景下的实用价值。
Q&A
后摩智能在WAIC 2026上展示了哪些M50 Inside终端产品?
后摩智能展示了多款由M50芯片驱动的端侧AI终端,包括Agent Computer(如全息交互个人智算中心ClawHouse X1 Pro、联想AI主机P7)、智能移动终端(如长城N90 Pro)、桌面机器人(联想AI Workmate概念机)以及端边推理设备(可道云TeamSilo A10)等。
M50芯片的算力和功耗表现如何?能运行多大参数的大模型?
M50芯片采用存算一体架构,在10W功耗下实现160 TOPS单芯片算力,可流畅运行30B至120B参数量级的大模型。
后摩智能的“大道软件栈”有什么特点?
大道软件栈是后摩智能自主研发的软件栈,可兼容主流深度学习框架并内置优化算子,客户无需手动调参和量化校准即可完成大模型部署,大幅缩短产品适配及开发周期。
联想AI主机P7在无网络环境下的本地推理速度是多少?
联想AI主机P7搭载M50芯片,综合算力达到190TOPS,可离线流畅运行高达1220亿参数大模型,无网络环境下本地推理速度达到50Tokens/s。
长城N90 Pro在离线办公方面有哪些功能?
长城N90 Pro借助M50芯片,可在无网环境下运行35B本地大模型,支持智能文档写作、离线问答、会议记录、灵感速记等办公全场景功能,并提升数据安全和隐私保护水平。
后摩智能与哪些企业建立了合作?
后摩智能已与联想、长城、中国移动等数十家头部终端企业建立深度合作,推动M50芯片在AI PC、桌面机器人、AI NAS、Agent Computer等多元终端中实现规模化商用。
端侧AI发展的核心瓶颈是什么?
当前大模型参数规模持续扩容,但终端设备的体积、电池功耗、散热空间存在刚性限制,算力、功耗、延时、部署等约束成为大模型规模化落地端侧的核心瓶颈。