2026年7月19日,在2026世界人工智能大会现场,国产GPU企业摩尔线程首次公开亮相其全新超节点产品——MTT C256。
该产品基于自主创新架构,首次实现单层Scale-up网络设计,在标准单宽机柜内达成128张GPU卡全互联;通过并柜扩展,可进一步构建256卡极速互联集群,从根本上缓解传统多层网络架构中存在的带宽衰减与通信延迟问题。
MTT C256采用计算与交换深度融合的高密度集成方案,显著提升智算中心单位空间内的GPU部署密度,为万卡乃至十万卡规模的长期稳定训练与推理任务提供坚实可靠的算力支撑。
其核心优势体现在三个方面:
一是高密度部署能力。单机柜GPU承载量处于行业领先水平,仅需两个机柜即可实现256卡单层Scale-up全互联,大幅降低数据中心物理空间占用;
二是极致互联性能。单层Scale-up网络支持256卡间低开销直连,卡间通信延迟控制在亚微秒级别,带宽利用效率更高,为分布式并行策略的深度优化预留充足空间;
三是生态兼容性。产品以2U标准节点形态设计,无缝适配当前主流智算软硬件体系,支持从万卡级向十万卡级集群的平滑演进与弹性扩展。
MTT C256面向三类关键智算场景:
在模型训练环节,作为十万卡级集群的核心单元,全面支撑大语言模型的预训练、后训练及强化学习等复杂任务;
在推理服务环节,原生适配大规模混合专家模型(MoE)架构,支持百万级超长上下文推理,兼具低延迟与高吞吐特性;
在推理解码环节,可应对高并发需求,单用户输出速率突破每秒100 token,特别适用于AI编程等对实时响应能力要求严苛的应用场景。
该超节点的技术壁垒,根植于一套经过大规模实践验证的工程化能力体系。通过高效液冷散热系统、三盲插硬件结构、完备的可靠性可用性可维护性(RAS)机制以及统一集群管理平台,产品在万卡以上规模的实际部署中展现出优异的稳定性与运维便利性。这套能力并非理论构想,而是源于摩尔线程在真实万卡级训练环境中的长期技术积累与产品化沉淀。

评论
更多评论