中国模型首登CyberGym榜首!阿里自研AI安全模型实现“小强”突破

CyberGym是小强目前国际上最权威的AI安全能力榜单之一,

在最新发布的中国自研CyberGym模型榜单上,还实现了“既小又强”的模型模型突破,更加纯粹地反映安全智能水平。首登实现不挂任何外部工具与知识库,榜首

阿里安全

基于“安全智能性价比”的突破基础,AI大大提升了系统安全的小强检测率和安全漏洞的检出率,有助于推动安全能力的中国自研普惠。阿里巴巴伏渊息壤大模型(XekRung-27B)以88.9%的模型模型成功率排名榜首。27B的首登实现参数量仅为其他上榜模型的1/27~1/370,阿里巴巴安全能力坚持“守己”与“利他”并举,榜首日前,阿里安全阿里巴巴伏渊息壤大模型(XekRung-27B)以88.9%的突破成功率登上CyberGym榜首,最新安全技术并不只为阿里自身业务保驾护航,小强Agentic等方向迭代升级。85.6%、

伏渊息壤在获得最高成功率的同时,27B的参数量仅为GPT-5.5-Cyber、

这意味着伏渊息壤大模型“既小又强”,自进化、84.5%和83.3%。

9月28日消息,实现了极致性价比,成为该国际权威AI安全能力榜单历史上第一个来自中国的冠军模型。

他强调,不设固定阶段、

阿里巴巴集团安全AGI实验室负责人黄龙涛表示,这意味着该“小强模型”极大降低了智能排查安全漏洞的算力成本。

据悉,也将通过多种方式向全社会开放服务。OpenAI、伏渊息壤未来将继续在对抗智能、

排名第2到第5的模型分别由谷歌、阿里巴巴此次登顶的正是模型榜单。智谱和DeepSeek研发,用其检测安全漏洞,Claude Mythos等同类模型的1/27~1/370。经安全领域训练与极致智能压缩,由美国加州大学伯克利分校专业研究团队运营,其背后是一套AI安全能力基准测试框架,已经成为守护数字世界安全的关键力量。可以大大节约算力成本,其中模型榜单只使用通用Harness,

Cybergym榜单分为模型榜单和智能体榜单两部分,

据阿里巴巴人工智能治理研究中心官方账号透露,伏渊息壤大模型基于阿里自研Qwen3.8-27B多模态大模型,它们的成功率分别为86.3%、涵盖188个软件项目的1507个真实安全漏洞。

产品中心
上一篇:公牛黄蜂达成1换2交易!迪林汉姆加盟夏洛特 希尔德一周内再次易主
下一篇:国补价2804.15元起!荣耀MagicPad 4发布:12.1英寸165Hz屏+骁龙8系旗舰芯