为什么昇腾384超节点能成为“镇馆之宝”?
文 观察者网 吕栋
机器人不仅能调酒、分拣还能格斗,AI眼镜不仅能翻译、导航还能支付,医疗大模型不仅能识别病理切片还能自动生成诊断报告,金融数字员工正从辅助工具变身“专业研究员”......这些画面并不是科幻电影,而是世界人工智能大会(WAIC 2025)被火爆围观的场景。
在这里,每个人都能感受到,中国AI应用创新正呈现百花齐放之势。但不可否认的是,无论AI技术在哪个场景落地,都离不开算力底座的支撑。尤其是在当下,随着全球AI竞争进入白热化,美国不断收紧技术出口管制,中国产业界更加呼唤底层软硬件的技术突破。
在国外巨头的先发优势下,外界之前或许对国产算力没有底气,但相信这次大会能打消不少人的疑虑。在昇腾384超节点的身后,华为全方位展现了昇腾算力底座的创新能力、训练及推理解决方案、开源开放的软硬件生态,以及在互联网、运营商、金融、能源、教育科研等11大行业的丰富实践。
适配和开发超80个大模型,孵化6000+个行业解决方案等数据,充分证明了昇腾绝对不是“花架子”,而是已形成技术、应用和生态的正向循环。
但实际上,大模型技术演进过程中,国产算力的挑战和机遇并存。一方面训练万亿参数大模型,仅靠单卡算力无法实现,集群算力成为大势所趋;另一方面,随着以DeepSeek为代表的MoE(混合专家模型)成为主流模型架构,其复杂混合并行导致通信需求骤增,单纯靠堆芯片,已不能带来有效算力的线性增加,但给提升通信带宽进而改善性能带来机遇。
在这种趋势下,华为充分发挥在通信、存储、基础软件等方面的大杂烩优势,通过非摩尔补摩尔、数学补物理等系统工程创新,成功实现业界最大规模的384颗昇腾NPU高速总线互联,构建了昇腾384超节点。它由12个计算柜和4个总线柜构成,算力总规模达300 PFLOPS。
之所以能实现这种超强性能,是因为昇腾超节点并非修补式改进,而是彻底重构系统。一是打破以CPU为中心的冯诺依曼架构,计算单元通过总线直接互访,转变为更高效、更灵活的全对等架构;其次,新的总线技术重新定义通信互联协议,减少系统开销,内存统一编址,超节点内全局TB级内存统一访问;第三,突破传统服务器间通信能力不足带来的系统性能瓶颈,实现通信能力10倍提升,让计算不再等待通信,提升算力利用率和整体性能。
1、美国内华达州一起枪击事件造成3死3伤,美国内华达州发生枪击案
2、穿什么lululemon,“棉绸”才是夏天的神9块9的穿搭自由。
3、提高生育一招——国家规定新生儿名字冠男女双姓,新生儿取名国家规定父母双方姓