288GB HBM加持!华为昇腾960提前2027年Q1上市,剑指Agent AI
- 悦禧新闻
- 2026-09-20
- 4807
9月17日,在华为全连接大会2026上,华为轮值董事长汪涛表示,华为的战略选择是聚焦AI基础设施,坚持打造硅基黑土地,让算力触手可及,坚持软件开源开放,让开发者释放潜能。坚持拥抱百模千态,让价值多元释放。

华为面向智能时代的重要部署:一、华为AI战略的核心是算力,坚持硬件变现;二是“超节点+集群”,打造中国坚实的算力底座,为世界构建新的选择;三是构建开源开放的算力生态,支持主流大模型原生训练。四是盘古大模型聚焦华为产品智能化,增强自身产品竞争力。
发布会的重点是,汪涛宣布昇腾芯片将遵循一年一代的迭代节奏,昇腾960系列提前就绪,性能实现倍增。
昇腾960DT可以支持2 PFLOPS的FP8、4PFLOPS FP4算力,片上HBM最大则支持288GB,访存带宽可以支持到9.6TB/秒,我们推出时间比原目标提前三个季度,在2027年第一季度就绪。昇腾960PR比原计划提前一季度,2027年第三季度可以准备就绪,未来,华为昇腾系列芯片将坚持一年一代的迭代节奏,在2028年和2029年,华为将继续推出昇腾970和980芯片。
记者将昇腾960DT和英伟达H100对比,发现昇腾960DT在AI推理当中,性能更加优秀,超大288G显存+9.6TB/s超高带宽+原生FP4,单卡可以容纳更大参数的大模型,减少多卡拆分,降低通信开销,对长上下文、多轮推理场景友好。

在大模型训练方面,两者稠密FP8理论值接近,H100成熟的Transformer Engine、稀疏算力,完整CUDA生态,当前在训练实测、算子优化、软件工具链上更强。昇腾需要靠CANN生态持续迭代补齐算子、框架适配。
王涛宣布,华为首个采用NPO技术的超节点——昇腾960超节点正式发布,单个昇腾960超节点可以实现4096卡规模,最大可以提供8亿 FLOPS FP8的算力,实现高达1PB的HBM容量,昇腾960超节点用5500个Hi-ONE模块,替代原本需要的48000颗800G光模块,功耗降低超过550千瓦,系统无故障运行的时间提升一倍,系统可用度可以达到99.8%。昇腾960风冷超节点和液冷超节点,分别将于2027年Q2和Q3陆续上市。
Hi One是目前行业最大传输能力的NPO产品,也是唯一实现内置光源的NPO产品,该产品把“高带宽、高可靠”与“低时延、低功耗”融合一体,与灵衢总线协议一起构建可规模扩展的超节点的互联系统。
针对大规模丛集需求,华为常务董事杨超斌指出,基于灵衢UnifiedBus总线协定,单一丛集最高可连结100万颗AI处理器,使10万卡丛集的模型浮点运算利用率(MFU)提升至35%。此外,华为更新了鲲鹏超节点,支援256 TB的统一存储器池,并发表AI记忆储存OceanStor M900。
在全连接大会上,汪涛披露的昇腾超节点的商业落地进展。昇腾超节点已经部署超过1000套,客户包括370多家;其中昇腾950超节点已开始规模商用。
已规模商用的昇腾950超节点同样依托灵衢互联协议构建,可组成当前行业规模最大的1024卡算力集群,输出1EFLOPS FP8、2EFLOPS FP4算力,并配套256TB全局统一内存编址空间,可支撑超大型千亿级大模型的全流程高效训练。





