昨天小米玄戒发布会上,公布了一个AI Cube原型机,这不是一个原型机这么简单,从设计上看已经相当成熟,关键是性能。
它专为本地大模型推理设计,采用三芯协同架构,将自研芯片深度融合,实现高性能端侧AI计算。核心配置为玄戒O3、O100与D100三颗芯片:
- O3 作为主控SoC,配备10核全大核CPU、16核G2-Ultra NX GPU和200 TOPS NPU,负责系统调度与通用计算。
- O100 是高带宽AI加速芯片,采用6nm 3D晶圆级堆叠封装,提供1.22TB/s近存计算带宽,专攻大模型推理加速。
- D100 为3nm智驾高算力芯片,拥有20核CPU、16核NPU,最高支持160GB统一内存(原型机约80GB),可承载超大模型。
AI Cube支持同时部署120B大模型与3B小模型,实现“快慢系统”实时切换:小模型负责快速响应日常任务,大模型处理复杂推理与编程。150W的功率能实现最330Tokens/s的输出速度。
这个产品很可能是小米布局个人AI终端的首款产品,是实现“人-车-家”生态的重要落子。

