2026年7月20日,在2026世界人工智能大会上,百度旗下昆仑芯科技首次公开展示了其面向大模型推理场景研发的第四代AI芯片M100实物。该芯片由昆仑芯首席执行官欧阳剑在公开活动中正式呈现。
M100全部采用国产供应链设计与制造,定位为高性价比推理专用芯片,主要技术指标对标国际主流产品H20。在核心配置上,其HBM显存容量略低于H20,但整体能效比与单位算力成本具备显著优势,适用于对成本敏感且对推理吞吐要求较高的大规模部署场景。
作为参考,H20基于Hopper架构,配备96GB HBM3显存,显存带宽达4.0TB/s,FP8精度下算力为296 TFLOPS,FP16精度下为148 TFLOPS,典型功耗为400W。该型号是面向特定市场的定制化产品,虽在峰值算力上较H100明显收敛,但凭借大容量显存与高带宽特性,在长序列、高并发推理任务中仍保持较强适用性。
M100的研发进展此前已在2025年11月的百度世界大会中披露。同期公布的还有面向超大规模多模态大模型训练与推理的M300芯片,计划于2027年初投入量产。
本次大会亦同步展出了已实现规模化交付的P800加速卡。该产品为昆仑芯2024年推出的第三代AI加速器,采用自研XPU架构,搭载96GB HBM显存,FP16精度算力达345 TFLOPS,并全面支持FP8、FP16及FP32等多种计算精度。
2025年4月,基于P800构建的3.2万卡规模AI超级集群成功完成首次系统级点亮;2026年4月,搭载P800的天池256卡超节点完成验证,实测吞吐性能较前代提升25%,推理效率提升50%。
目前,昆仑芯正持续推进新一代P系列高性能AI芯片的研发工作,目标直指当前国内高端AI算力领域的代表型号之一。
据行业研究机构统计,2025年中国AI加速卡总出货量约为400万张,其中国产厂商合计出货约165万张,市场占有率为41%。在国产阵营中,昆仑芯与另一家头部企业并列第三,出货量均为11.6万张;前两位分别为出货81.2万张的华为昇腾和26.5万张的阿里平头哥。

评论
更多评论