9月28日消息,日前,阿裏巴巴伏淵息壤大模型(XekRung-27B)以88.9%的成功率登上CyberGym榜首,成為該國際權威AI安全能力榜單歷史上第一個來自中國的冠軍模型。
伏淵息壤在獲得最高成功率的同時,還實現了“既小又強”的突破,27B的參數量僅為其他上榜模型的1/27~1/370,這意味著該“小強模型”極大降低了智能排查安全漏洞的算力成本。
據悉,CyberGym是目前國際上最權威的AI安全能力榜單之一,由美國加州大學伯克利分校專業研究團隊運營,其背後是一套AI安全能力基準測試框架,涵蓋188個軟體專案的1507個真實安全漏洞。
Cybergym榜單分為模型榜單和智能體榜單兩部分,其中模型榜單只使用通用Harness,不設固定階段、不掛任何外部工具與知識庫,更加純粹地反映安全智能水準。阿裏巴巴此次登頂的正是模型榜單。
在最新發佈的CyberGym模型榜單上,阿裏巴巴伏淵息壤大模型(XekRung-27B)以88.9%的成功率排名榜首。
排名第2到第5的模型分別由穀歌、OpenAI、智譜和DeepSeek研發,它們的成功率分別為86.3%、85.6%、84.5%和83.3%。
據阿裏巴巴人工智慧治理研究中心官方帳號透露,伏淵息壤大模型基於阿裏自研Qwen3.8-27B多模態大模型,經安全領域訓練與極致智能壓縮,27B的參數量僅為GPT-5.5-Cyber、Claude Mythos等同類模型的1/27~1/370。
這意味著伏淵息壤大模型“既小又強”,實現了極致性價比,用其檢測安全漏洞,可以大大節約算力成本,有助於推動安全能力的普惠。
阿裏巴巴集團安全AGI實驗室負責人黃龍濤表示,AI大大提升了系統安全的檢測率和安全漏洞的檢出率,已經成為守護數字世界安全的關鍵力量。
基於“安全智能性價比”的基礎,伏淵息壤未來將繼續在對抗智能、自進化、Agentic等方向迭代升級。
他強調,阿裏巴巴安全能力堅持“守己”與“利他”並舉,最新安全技術並不只為阿裏自身業務保駕護航,也將通過多種方式向全社會開放服務。
來源:中國快科技