中关村在线

热点资讯

华为发布昇腾950超节点:全球首个千芯统一AI超级计算系统

2026年9月21日,在2026世界人工智能大会上,华为首次公开展示其最新研发的超大规模AI计算系统——昇腾950超节点真机。该系统是当前行业内规模最大的单体超节点产品,专为支撑万亿参数级大模型训练及高并发中心化推理任务而设计。

昇腾950超节点采用液冷架构,定位为一台逻辑统一的超级计算设备,旨在将上千颗NPU集成于统一计算平面,从根本上缓解大模型训练中长期存在的多卡间通信延迟问题。

系统以昇腾950DT NPU芯片为核心计算单元。该芯片针对大模型训练与解码推理场景深度优化,集成HiZQ 2.0 HBM高带宽内存,单卡配备144GB HBM容量与4TB/s内存带宽,全面支持FP16、BF16、FP8、MXFP4等多种精度计算模式,可高效适配大模型预训练、超长上下文推理以及MoE混合专家架构等前沿应用需求。

整套系统采用模块化架构设计,标准配置包括16台计算柜与4台灵衢互联柜,最高可容纳1024颗昇腾950DT NPU,并协同部署256颗鲲鹏950 CPU。全系统峰值算力达1 EFLOPS(FP8精度)与2 EFLOPS(FP4精度)。

互联方面,系统搭载自研灵衢2.0全光互联协议,实现跨机柜级全光Mesh直连拓扑,集群总互联带宽达1.72PB/s,跨柜往返时延低至3微秒。同时支持256TB全局内存统一编址,使上千颗NPU可直接共享同一内存空间,彻底规避传统多服务器架构中频繁搬运海量模型参数带来的通信开销,显著降低训练过程中的通信损耗。

散热系统采用全覆盖式液冷方案,单计算柜最大供电能力达100kW,保障超高密度算力持续稳定输出;在可靠性设计上,系统引入2+2光路冗余保护机制,灵衢链路具备毫秒级闪断自恢复能力,即使局部链路出现异常,业务运行亦不受影响,全面满足7×24小时不间断大模型训练的严苛要求。

软件层面,系统深度集成昇腾CANN全栈软件平台,提供完整开发工具链,全面支持模型迁移、分布式训练优化等关键能力。

相较于传统AI集群依赖多台独立服务器协作的方式,昇腾950超节点的核心突破在于打破物理服务器边界,将上千颗NPU构建成单一逻辑计算实体,实现真正意义上的协同运算。这一架构革新大幅提升了万亿参数模型的训练效率,有力支撑Agent智能体、超长上下文理解等新一代高算力需求场景。

该产品计划于2026年第四季度正式投入市场。未来还可通过多套超节点互联方式,进一步构建更大规模的算力集群,持续拓展AI基础设施的承载边界。

展开全文
人赞过该文
内容纠错

相关电商优惠

评论

更多评论
还没有人评论~ 快来抢沙发吧~

读过此文的还读过

点击加载更多

内容相关产品

说点什么吧~ 0

发评论,赚金豆

收藏 0 分享
首页查报价问答论坛下载手机笔记本游戏硬件数码影音家用电器办公打印 更多

更多频道

频道导航
辅助工具