中关村在线

热点资讯

国产大模型密集发布,万亿参数时代加速迈向2万亿新台阶

2026年7月19日,国产大模型迎来密集发布期。继Kimi K3以2.8万亿参数引发行业关注后,DeepSeek V4正式版已进入发布阶段,千问最新基座模型Qwen-3.8 Max也已上线官网预览页面,目前处于Preview阶段。

Qwen-3.8 Max被定位为新一代通用大模型,参数规模达2.4万亿。该模型在代码生成、专业办公协同与复杂逻辑推理等关键能力维度上,展现出系统性提升。尽管尚未公布第三方基准测试结果或实测数据,但其参数量已位居国内前列,仅次于Kimi K3,与MiniMax即将推出的M3 Pro(预计2.7万亿参数)共同构成当前2至3万亿参数量级的第一梯队。

值得注意的是,仅三个月前发布的DeepSeek V4 Pro以1.6万亿参数成为当时国产旗舰模型的标杆;而今,这一数字已退居国内头部阵营中参数规模最小者。这反映出整个国产大模型研发节奏显著加快,技术演进速度远超预期。

参数规模并非唯一性能指标。实践表明,高质量的后训练与对齐优化可显著放大模型潜力——例如智谱GLM-5.2虽仅7400亿参数,却在编程任务中保持顶尖表现。据悉,智谱后续将推出GLM-5.3或GLM-5.5,参数量有望突破万亿门槛。

整体来看,国内主要模型厂商已普遍迈入万亿参数时代,部分产品更跃升至2万亿以上量级。这背后是训练算力基础设施的实质性升级。当前瓶颈正逐步转向推理端:包括GLM-5.2、Kimi K3在内的多款高参数模型,在实际服务稳定性与响应效率方面仍面临挑战,推理算力的持续投入与架构优化,将成为下一阶段的关键着力点。

展开全文
人赞过该文
内容纠错

相关电商优惠

评论

更多评论
还没有人评论~ 快来抢沙发吧~

读过此文的还读过

点击加载更多

内容相关产品

说点什么吧~ 0

发评论,赚金豆

收藏 0 分享
首页查报价问答论坛下载手机笔记本游戏硬件数码影音家用电器办公打印 更多

更多频道

频道导航
辅助工具