过去一周,一款代号为Ox-Alpha的大型人工智能模型引发广泛关注,业内曾以“牛来大模型”为其非正式命名。经过确认,该模型由国内人工智能企业智谱研发,属于其GLM系列最新成果。
目前,该模型的正式名称尚未对外公布,市场推测可能命名为GLM-5.3 Flash。智谱已明确确认其归属,并计划于今日晚间向公众开放模型权重。
在能力维度上,牛来大模型未在纯文本性能方面超越现有GLM-5.3版本,但实现了显著扩展:它具备多模态理解与生成能力,原生支持图像与视频输入输出。整体技术表现仍处于行业前列,可视为DS V4 Flash的增强演进版本。
此前,关于该模型来源存在多种猜测——有人认为出自小米Mimo V3 Pro,也有人推测来自谷歌Gemini或苹果自研AI系统。这些说法虽一度流传甚广,但最终均被模型底层特征识别结果所证伪。早在早期分析阶段,技术层面的模型指纹已指向智谱,此次官方确认进一步印证了这一判断。
相较于模型本身的能力提升,本次发布更具战略意义的是其背后所依托的算力基础设施。智谱宣布,在牛来大模型免费开放首周,将每日提供高达100万亿Token的算力支持。
作为参照,仅OpenRouter平台单周调用量已达17.5万亿Token,已超过此前长期领先的V4 Flash;OpenCode平台在8月22日单日调用量即达5.1万亿Token;此外,Hermes、OMP等渠道的调用规模亦相当可观。即便将上述所有公开渠道加总,仍未触及智谱所承诺的100万亿Token日均上限。
这一数字意味着智谱已构建起规模空前的AI算力体系。以当前实测平均调用量2.5万亿Token/日推算,对应算力约2.3 EFLOPS;若换算为B200级别加速卡,则需1300至2100张。而100万亿Token的日目标,折合算力需求约为6万至9万张B200显卡——这一配置规模在当前全球AI基础设施中极为罕见。
考虑到智谱并非仅运营单一模型,其整体算力储备远超外界普遍预期。此前已有消息显示,该公司已建成一座算力达1吉瓦的全自主可控AI数据中心,全部采用国产芯片。若该中心已投入实际运行,则此次牛来大模型为期一周的免费开放,仅是其强大底座的一次初步验证。
综上,牛来大模型的出现,不仅为中国人工智能领域增添了一款具备实战竞争力的多模态大模型,更标志着国产AI企业在核心算力供给能力上取得实质性跃升。当算力差距不再成为决定性瓶颈,中国大模型技术向国际前沿快速靠拢的步伐将更加稳健而有力。

评论
更多评论