2026年9月28日,阿里巴巴发布伏渊息壤大模型(XekRung-27B),在国际权威AI安全能力评估平台CyberGym最新一期模型榜单中以88.9%的成功率位列第一,成为该榜单设立以来首支登顶的中国团队研发模型。
该模型在达成最高成功率的同时,展现出显著的轻量化优势:参数量仅为270亿,相当于同榜其他主流安全大模型的1/27至1/370。这一“小而强”的技术路径大幅降低了安全漏洞智能识别所需的算力投入,使高水准AI安全能力具备更广泛的落地条件与应用可行性。
CyberGym由美国加州大学伯克利分校专业研究团队主导建设,是当前全球最具公信力的AI安全能力评估体系之一。其基准测试框架覆盖188个真实软件项目,包含1507个经人工验证的已知安全漏洞,全面检验模型对复杂安全问题的理解、推理与修复建议能力。榜单分为模型榜单与智能体榜单两类,其中模型榜单严格限定仅使用通用Harness框架,不依赖预设流程、不接入外部工具或知识库,纯粹评估模型本体的安全智能水平。伏渊息壤此次夺冠即出自该核心赛道。
紧随其后的是谷歌、OpenAI、智谱与DeepSeek研发的四款模型,成功率分别为86.3%、85.6%、84.5%和83.3%。
伏渊息壤基于阿里自研Qwen3.8-27B多模态基础模型,深度融合安全领域知识,并通过高强度定向训练与智能压缩技术实现性能跃升。其参数规模远低于GPT-5.5-Cyber、Claude Mythos等对标模型,却在漏洞识别准确率与泛化能力上实现反超,标志着安全大模型正从“大而全”向“精而专”演进。
阿里巴巴集团安全AGI实验室负责人黄龙涛指出,人工智能已深度融入系统安全防护体系,显著提升漏洞发现效率与风险响应精度,成为保障数字空间稳定运行的核心支撑力量。伏渊息壤以“安全智能性价比”为设计原点,后续将持续强化对抗性推理、自主演化与智能体协同等前沿方向的技术积累。
他同时强调,安全能力的建设始终秉持“守己”与“利他”双重使命——既为自身业务筑牢防线,也致力于通过标准化接口、开源组件及行业协作机制,将先进安全技术能力向社会开放,助力构建更普惠、更韧性的数字安全生态。

评论
更多评论