时间:2025-07-27 12:01 作者:易飘零
华为首次展出“算力核弹”真机,获评镇馆之宝
(文/观察者网 吕栋)
在当下,大模型训练和推理对算力需求的爆炸式增长,但传统计算架构面临资源利用率低,故障频发等挑战,难以支撑AI技术的代际跃迁,这就算力集群的系统工程能力提出更高要求。
今年5月,在鲲鹏昇腾开发者大会上,华为推出了昇腾384超节点,由12个计算柜和4个总线柜构成。这个体积庞大的“算力核弹”,成功实现业界最大规模的384个NPU卡高速总线互联。根据现场介绍,昇腾超节点具备超大带宽、超低时延、超强性能的三大优势,包括多款训练和推理产品。
相比英伟达NVL72等行业超节点方案,昇腾超节点最关键的创新,在于彻底打破了传统以CPU为中心的冯诺依曼架构,既“主从架构”,创新提出了“全对等架构”,凭借高速互联总线的关键突破,把总线从服务器内部扩展到整机柜、甚至跨机柜,最终将CPU、NPU、DPU、存储和内存等资源全部互联和池化,这样就能去除掉繁多的中转环节,从而实现真正的点对点互联,进而实现更大的算力密度和互联带宽。
纵观国内,目前使用全国产芯片构建超节点,还能全面超越英伟达NVL72的,只有华为。昇腾384超节点通过全新高速网络MatrixLink全对等互联,形成一台超级“AI服务器”,它的算力总规模达300Pflops,是英伟达NVL72的1.7倍;网络互联总带宽达269TB/s,比英伟达NVL72提升107%;内存总带宽达1229TB/s,比英伟达NVL72提升113%;单卡推理吞吐量跃升到2300 Tokens/s。
昇腾384超节点架构
本文系观察者网独家稿件,未经授权,不得转载。
1、机器人“快递员”将在WAIC全球直播首秀,首批具身机器人已率先进厂拧螺丝
3、促进农产品消费,十部门联合发布23条措施,推动农产品上行