华为今天官宣:下一代 AI 芯片昇腾 960,提前就绪,性能翻番。
先看这颗芯片本身的规格:FP8 算力单卡 2 PFLOPS,HBM 内存 288GB、带宽 9.6TB/s,互联带宽 2.2TB/s—— 相比昇腾 950,算力、内存容量、内存带宽、互联端口全部翻倍。华为的说法是 "一年一代、算力翻倍",960 就是这条路线上的第三棒。
但 960 真正的看点不在单卡,在 "超节点":华为把 15488 颗 960 连成一台超级计算机 ——Atlas 960 SuperPoD,FP8 总算力 30 EFLOPS,互联带宽 34PB/s,号称训练性能比上一代提升 3 倍、推理提升 4 倍以上。单颗芯片被卡脖子,就用集群堆出规模,这是华为被制裁六年练出来的打法。
为什么重要?因为国产大模型的算力底座正在 "换芯":此前 DeepSeek 已被曝计划采购 16 万颗昇腾 950DT;今天华为又宣布昇腾超节点部署突破 1000 套。英伟达的不可替代性,正在被一块一块国产芯片撬动。
说句实在话:960 要到 2027 年一季度才真正就绪,今天官宣的是 "提前",不是 "上市"。但方向已经很清楚 —— 中国 AI 的算力自主,已经从 "能不能造" 走到了 "够不够用" 的下一题。
