阿里云于2026年7月28日宣布,真武M890超节点实例已实现对Kimi K3模型的首日全面适配,成为国内首个成功运行近三万亿参数规模模型的超节点系统。
Kimi K3模型参数量达2.8万亿,其运行需将海量参数高效分布于数十乃至上百张高速互联的GPU设备之上。传统AI集群受限于通信带宽,难以满足该类模型对高吞吐、低延迟及高并发的严苛要求。
真武超节点专为突破此类算力瓶颈而设计。其核心计算单元真武M890芯片采用自研并行计算架构,单颗芯片配备144GB显存。磐久AL128超节点服务器则基于自研AI芯片与互联芯片构建,单机柜集成128张加速卡,实现紧密耦合互联,点对点通信时延低于150纳秒。
依托ICN Switch 1.0互联芯片,64颗真武M890可达成800GB/s的双向互联带宽,整套系统显存总容量达9TB。单个超节点实例即可支撑万亿级参数规模的MoE模型规模化部署。
为充分释放Kimi K3的运行效能,阿里云联合平头哥及Kimi研发团队,在软件栈、核心算子等多个层面开展深度协同优化。真武M890针对该模型特有的计算结构进行了专项算子重构,显著提升推理过程中的算力利用效率与内存带宽利用率。
实测结果表明,完成适配后,模型生成首个Token的响应时延下降约35%,单卡解码吞吐量提升1.8倍,系统可长期稳定支持百万级长度上下文的复杂应用场景。
千问AI平台与阿里云百炼平台将同步开放Kimi K3的模型API服务,推动模型能力与平台生态深度融合。
当前,全球主流大模型正加速迈入超两万亿参数阶段。真武超节点不仅实现了Kimi K3的成功部署,更保障了其高效、稳定、可持续的运行表现,标志着国产智能算力已具备全面支撑超大规模参数模型实际落地与规模化应用的核心能力。

评论
更多评论