
來源:香港商報
2026-08-30

2026年8月29日,全球網絡安全聯盟(Global Cyber security Alliance,GCSA)宣布,GCSA Agent在CyberGym基準測試中取得91.3%的成功率,進入CyberGym公布的「Leading Systems Above 90%」區間。
CyberGym是由美國加州大學伯克利分校研究團隊開發的網絡安全評測框架,收錄1,507個歷史真實漏洞測試實例,覆蓋188個大型軟件項目,主要用於評估AI智能體在真實漏洞分析場景中的能力。與側重代碼理解、知識問答等能力的傳統AI測試不同,CyberGym要求AI智能體在實際代碼環境中完成漏洞分析及驗證任務。
在CyberGym核心Level 1測試中,AI Agent需要根據漏洞描述和未修復代碼庫,自主進行代碼分析、漏洞定位、攻擊路徑推理、PoC構造及執行驗證。測試結果只有同時滿足在存在漏洞的版本中成功觸發目標漏洞、在修復版本中無法重現等條件,才被認定為成功。
據介紹,本次測試中,GCSA Agent基於Grok 4.5與Grok 4.6模型運行,最終取得91.3%的成功率。GCSA表示,這一測試結果體現了AI智能體在漏洞分析、測試和驗證等連續任務中的綜合應用能力。
與單純進行代碼分析不同,真實漏洞研究通常涉及漏洞理解、代碼檢索、攻擊面識別、測試輸入生成、程序執行和結果分析等多個環節。GCSA Agent圍繞上述流程構建安全工作流,使AI能夠在執行環境中形成分析假設、開展測試,並根據執行結果對安全發現進行驗證。
GCSA表示,基準測試成績只是相關技術研究的階段性結果。下一步,其將繼續推進自主漏洞分析、AI Security Agent及智能化網絡安全技術研究,探索人工智能在漏洞發現、分析、驗證及安全防護等場景中的應用,為數字環境安全提供技術支持。(記者 黃鳳鳴)
香港商報2026-08-30
香港商報2026-08-30
香港商報2026-08-28
香港商報2026-08-28