OpenAI首款達標「關鍵」級網絡安全標準的人工智慧模型
OpenAI最新研發的AI模型Astra,首次獲得公司定義的「關鍵」(Critical)安全評級,成為全球首台達此水準的人工智慧系統。該模型能自動識別複雜且高風險的安全漏洞,並在無需人工干預的情況下自主生成有效利用代碼,標誌著人工智慧在網絡攻防領域的能力邁入新階段。
Astra在高風險漏洞利用檢測上的優異表現
OpenAI官方指出,Astra於內部開發的ExploitBench評測套件中,針對20項嚴重的V8瀏覽器核心漏洞實現100%命中率。相比先前版本GPT-5.6 Sol,Astra不僅輸入指令更少,卻達成更高比例的代碼成功執行率。測試期間,Astra更挖掘並合利用了兩個先前未公開的零日漏洞,相關資訊已通報給負責維護的安全團隊,促使漏洞得以修補。
另外,獨立安全測試確認,Astra能構建複雜的瀏覽器攻擊鏈,成功實現沙箱逃逸並在宿主系統運行命令。此類表現顯示,Astra在漏洞發現及利用生成方面明顯優於以往模型,其漏洞識別及開發效率取得重大突破。
發布前積極加強安全防護並分階段有限度開放
基於模型強大的攻擊能力,OpenAI在公開前進行多輪嚴格安全強化。自8月28日起,Astra陸續納入多項安全策略於強化學習訓練中,內部測試顯示其拒絕網絡越獄嘗試率達91.5%,遠高於GPT-5.6 Sol的59%,並針對高風險使用者施加更嚴苛的操作限制。
OpenAI同時導入「思維鏈」監控技術,即時發現並阻斷潛在違規動作。在蜜罐測試環境下,未加強安全措施的GPT-5.6 Sol逾半嘗試進行週邊系統滲透,Astra則未曾發起任何類似嘗試,反映其安全防護更加成熟可靠。
公司計畫先讓有限的阿爾法測試者使用Astra,隨後透過「Daybreak Blue」專案分階段向防禦需求用戶開放,強調雖安全限制會略影響便利性,卻是確保技術安全推廣的關鍵步驟。
OpenAI展現安全優先策略 引領AI網安新標竿
OpenAI執行長Sam Altman於社群平台指出,公司將加速推動安全優先的技術迭代,強調功能與安全必須齊頭並進。他提及下一代模型將於近期發布。Astra的誕生不僅提高人工智慧於網絡安全領域的技術門檻,也可能在資訊安全、自動化漏洞偵測與防禦機制部署方面,引發產業及監管機構的新關注。
作為全球人工智慧研發的重要推手,OpenAI此舉展現了將高風險技術釋放與安全控管並重的策略。市場將持續關注Astra實際應用成效及其對整體網絡安全生態系的潛在影響。