韓國崇實大學人工智慧安全性研究中心(Soongsil AISC,主任為崔大善教授)所開發的多智能體漏洞分析系統「mneme」,近日登上全球網絡安全 AI 評測體系 CyberGym 的公開排行榜。研究中心指出,截至 2026 年 8 月 30 日,這是韓國國內研究團隊首次、亦是現時唯一一次登上該榜單的紀錄。「mneme」一字源自希臘語,意為「記憶」,系統設計核心是將過往漏洞分析中累積的知識整理為結構化的因果記憶,再由多個人工智慧智能體主動調用,藉以推斷新漏洞的成因與重現路徑。
與 Microsoft MDASH 表現持平
在 CyberGym Level 1 全部 1,507 項任務中,mneme 憑單次嘗試取得 91.0% 的成功率,與 Microsoft 的多智能體漏洞分析系統 MDASH 表現持平。研究中心透露,相關評估於 2026 年 7 月 13 日完成,91.0% 為當時公開的最高成績,按提交時點計算相當於全球並列第一。這項結果顯示,韓國本土研發的網絡安全智能體已具備與國際頂尖系統同台競爭的能力。
CyberGym 側重實戰能力綜合評測
CyberGym 是一套針對開源軟件漏洞而設的大規模實戰型基準測試,基於從 188 個開源軟件項目中所收集的 1,507 個漏洞,要求人工智慧分析源代碼、追蹤漏洞形成路徑,並編寫、執行能夠真實重現漏洞的程式碼。該測試評核的並非單一的安全知識或代碼生成能力,而是代碼理解、漏洞推理、專業工具調用、反覆執行與結果驗證的綜合水平,因此被視為衡量網絡安全專用 AI 與智能體實戰能力的關鍵全球指標。
超越 Claude Mythos Preview 紀錄
在此之前,今年 4 月 Anthropic 的通用人工智慧模型 Claude Mythos Preview,在 CyberGym 以模型為中心的評測中曾取得 83.1% 的成績,位居當時最高水平。mneme 的 91.0%,較該紀錄高出 7.9 個百分點,進一步確立其在漏洞分析實戰領域的領先地位。研究中心表示,將持續優化系統,並推動相關技術在不同安全場景中的應用。

