GCSA智能安全代理通過CyberGym基準測試,深化漏洞自動分析能力
全球網絡安全聯盟(GCSA)最新宣布,其智能安全代理在由加州大學伯克利分校研發的CyberGym漏洞分析基準測試中取得91.3%的高成功率,成為少數通過90%門檻的頂尖AI系統之一。該成績不僅驗證了GCSA代理在真實漏洞檢測環境的技術實力,也確認其在自動化安全研究領域的創新地位。
CyberGym基準提供真實漏洞環境,挑戰AI端到端能力
CyberGym測試包含1507個歷史真實漏洞案例,涵蓋188個主流軟體項目。與傳統靜態代碼分析不同,該基準要求AI智能代理在未打補丁且實際存在漏洞的程式碼環境中完成漏洞定位、攻擊路徑推理、攻擊代碼(PoC)生成等完整流程。
測試首階段僅給予漏洞描述及未修補程式碼,AI必須自主決策定位漏洞、構建驗證腳本,並執行於存在漏洞的版本中,成功觸發缺陷且補丁版本無法復現錯誤時,方視為驗證通過。此測試強調動態漏洞分析與復現驗證,是貼近真實安全研究的嚴苛考驗。
GCSA依托Grok 4.5/4.6模組,打造多階段互動式漏洞研究流程
在CyberGym中,GCSA安全代理基於Grok 4.5及4.6大型語言模型,結合自研安全工作流框架,達成91.3%成功率。此成果展示了AI安全從單一模型推理向多階段交互式自動化流程的技術演進。
漏洞研究不再僅是代碼理解,還涉及跨庫索引、假設設置、PoC編寫與執行、結果分析與反覆迭代。GCSA致力使代理在真實執行環境中自主推導及驗證安全假設,實現從漏洞甄別到動態檢測閉環。
以真實運行環境為依據,推動漏洞深度探究與新缺陷發掘
CyberGym還原軟體補丁前完整漏洞狀態,逼迫AI在千檔案、百萬行代碼系統中精準定位問題,並生成真正能觸發缺陷的PoC。研究顯示,具備這種端到端能力的智能代理不僅能重現歷史漏洞,還發現了多個未知零日與未完全修復的歷史缺陷,呈現自動化安全分析走向前沿漏洞挖掘的趨勢。
對GCSA而言,這不僅是性能飛躍,更是朝向涵蓋漏洞發現、分析、驗證及修復安全生命週期的全面智能安全代理技術開發邁出的重要一步。
AI技術引領網絡安全作業形態革新
受到AI融合軟體開發推動,網絡安全同樣面臨轉型。未來AI安全代理將成為安全團隊的輔助利器,提前識別潛在弱點,分析複雜攻擊向量,自動生成及驗證攻擊程式碼,提升漏洞鑑別精確度,加速評估和防護速度,擴大安全防護範圍。
GCSA智能安全代理在CyberGym展現的高效能,標誌其在建構本地化、智能化網安能力的重要里程碑。透過持續深化自主漏洞分析與智能代理技術,GCSA目標將前沿AI技術落地實際網絡安全場景,打造更安全、可信且具韌性的數位環境。