2026年1月16日,智谱宣布与华为联合推出的新一代开源图像生成模型GLM-Image,在发布不到24小时内迅速登顶全球主流AI开源社区排行榜首位。该模型成为首个完全基于国产芯片训练并在国际开源榜单中位居第一的国产人工智能模型,标志着我国在AI领域实现从底层硬件到上层模型的全链路自主技术突破。
GLM-Image的训练全过程依托昇腾Atlas 800T A2计算设备及昇思MindSpore AI框架完成,覆盖数据处理与模型训练各个环节,是首个在国产算力平台上实现端到端训练并达到国际领先水平的多模态SOTA模型。在架构设计上,该模型未采用当前主流的LDM方案,而是创新性地融合自回归机制与扩散解码器,形成混合结构,在整体语义理解与局部图像细节生成之间实现更优平衡。
在多项权威测评中,GLM-Image于复杂视觉文本生成CVTG-2K和长文本渲染LongText-Bench两项榜单均位列开源模型第一。其对指令的理解能力突出,文字生成准确,尤其在汉字图像生成方面表现优异,适用于海报设计、演示文稿制作、科普插图等对知识表达要求较高的应用场景。
在实际应用层面,GLM-Image支持API调用方式,单张图像生成成本低至0.1元,显著降低了企业与开发者接入高性能图像生成技术的门槛,为广泛行业应用提供了高性价比的解决方案。

评论
更多评论