实测小米 AI 手机:性能超 iPhone,端侧 AI 超级快

实测小米 AI 手机:性能超 iPhone,端侧 AI 超级快

💡 原文中文,约1900字,阅读约需5分钟。
📝

内容提要

小米发布玄戒O3、O100和D100三款自研芯片,并展示两台原型机:折叠屏手机本地运行3B模型,生成速度达303 tokens/s,响应延迟0.45秒;AI Cube桌面终端内置80GB内存,可本地部署120B模型,生成代码并运行应用。两者分别侧重轻量秒回和重度推理,展现端侧AI离线能力,未来或量产低门槛AI算力设备。

🔎

延伸解读

端侧AI的两种路径

小米展示了端侧AI的两种探索方向:折叠屏原型机通过专用加速芯片和主动散热,在有限空间内实现3B模型的秒级响应;AI Cube则利用桌面空间和多芯片协同,本地运行120B大模型。前者强调轻量高频的即时交互,后者侧重重度推理任务,体现了不同硬件尺寸下的明确分工。

性能与体验的平衡

实测中,折叠屏原型机的生成速度达303 tokens/s,响应延迟仅0.45秒,已快于人眼阅读节奏,适合文档润色、同声传译等场景。AI Cube则通过3B+120B双模型切换,兼顾简单问题的快速响应和复杂代码生成的深度推理,展示了端侧AI在实用性和能力上的平衡。

隐私与离线优势

两台原型机均在断网状态下运行,数据不出本地,强调了端侧AI的隐私保护优势。对于用户而言,这意味着无需依赖云端即可获得AI服务,尤其适合对数据敏感或网络环境受限的场景。不过,文章未提及具体隐私技术细节,实际安全性仍需进一步验证。

Q&A

小米在技术沟通会上展示了哪些搭载自研芯片的原型机?

小米展示了两台原型机:一台是折叠屏手机原型机,背面加装了主动散热风扇,断网状态下本地运行3B模型;另一台是桌面计算终端AI Cube,内置80GB内存,本地部署120B模型。

小米折叠屏原型机本地运行大模型的性能如何?

该原型机在断网状态下本地运行小米MiMo 3B模型,响应延迟(TTFT)约0.45秒,生成速度实测303 tokens/s,峰值可达330 tokens/s。

小米AI Cube原型机有哪些特点和功能?

AI Cube采用航空铝CNC一体成型,机身有33874个散热孔,内置80GB内存(最高支持160GB),运行Android系统,本地部署120B大模型,可生成代码并运行应用,如生成一个功能完整的Web Audio在线钢琴。

AI Cube的快慢双模型切换是如何工作的?

AI Cube支持3B和120B双模型切换,轻量高频指令由3B小模型秒回,复杂推理任务如代码生成交给120B模型处理,兼顾响应速度和推理能力。

小米展示的两台原型机分别侧重什么应用场景?

折叠屏原型机侧重轻量高频的即时交互,如文档润色、同声传译,强调离线秒回;AI Cube侧重重度复杂推理,如代码生成,适合桌面办公场景。

端侧AI相比云端AI有哪些优势?

端侧AI完全不依赖网络,数据不出本地,保护隐私,且响应速度快,如折叠屏原型机可实现即问即答的跟手体验。

小米未来可能推出什么样的AI设备?

小米可能量产低门槛的AI算力设备,让每个人都能在本地运行自己的大模型,成为“年轻人的第一台AI算力中枢”。

🏷️

标签

➡️

继续阅读