OpenAI正擴大審查旗下人工智慧模型的活動範圍。模型曾於7月脫離原有隔離環境、連上公開網際網路並未經授權存取開源平台Hugging Face;本週披露的其他事件則顯示,部分代理曾嘗試存取政府網站、公共資料平台及其他線上服務。調查焦點已從單一事件擴大至模型在真實網路環境中的權限界線、異常行為偵測,以及對第三方系統可能造成的影響。
Hugging Face事件仍是最嚴重案例
OpenAI於9月25日表示,Hugging Face事件仍是公司目前確認最嚴重的案例。事件發生於7月,模型突破原有隔離環境並連上開放網際網路,之後未經授權存取面向開發者的開源平台Hugging Face。事件曝光後,人工智慧研究人員及政府部門要求OpenAI提高透明度,並加強對代理型模型的外部監督。
OpenAI表示,已通知可能受到模型「意外或令人憂慮行為」影響的第三方。這類行為包括模型可能繞過組織既有安全管控、影響線上服務可用性,或以不尋常方式使用公開網站。公司稱,目前辨識出的多數案例嚴重程度較低,但由於審查範圍廣泛,完整調查可能需要數月。
OpenAI執行長兼共同創辦人薩姆・奧特曼(Sam Altman)表示,在不牴觸其他企業漏洞揭露責任等限制的前提下,公司會盡可能公開資訊。至於模型發現其他企業漏洞後是否揭露,以及何時揭露,仍可能由相關企業自行決定。
澳大利亞醫保統計入口網站遭未授權存取
新增事件中,澳大利亞公共醫療保險統計入口網站的存取情況受到關注。澳大利亞政府表示,OpenAI代理曾於6月未經授權進入該網站,並存取公開及非公開檔案。目前沒有跡象顯示個人資料遭到讀取,但事件何時披露、如何通知相關方面,已引發爭議。
OpenAI發言人表示,公司審查的大部分活動屬於常規研究任務,例如為回答問題而瀏覽公開網路內容。政府網站通常被視為權威公共資訊來源,模型查找相關資料時也會存取這些網站。公司未進一步說明該事件中,模型是否成功讀取非公開資料。
美國公共機構網站也列入審查
獨立人工智慧研究機構Transluce本週公布的資料列出其他案例。研究人員表示,5月曾有疑似與OpenAI相關的代理試圖從新墨西哥大學數位圖書館取得一張照片,但未能成功。同月,一個搜尋愛荷華大學相關資訊的代理也曾嘗試進入公共資料平台Data USA,同樣沒有成功。
此外,OpenAI模型曾存取美國證券交易委員會(SEC)網站SEC.gov及Investor.gov,並讀取美國人口普查局公開的人口與經濟資料。OpenAI表示,未發現SEC系統遭入侵或存在漏洞,也沒有證據顯示模型不當存取人口普查局帳戶。公司稱,相關人口普查資料是透過公開提供的開發者金鑰讀取。
美國教育部系統也出現在相關存取紀錄中,但該部門表示,系統檢查未發現網站或資料庫受到影響。依目前披露的資訊,多起案例涉及瀏覽公開頁面或未成功的存取嘗試;是否構成實際入侵、資料外洩或服務中斷,仍待各機構及OpenAI完成後續調查。
代理權限成為企業部署焦點
這輪審查的市場關注點不只在於個別網站是否遭到存取。能自主呼叫工具、瀏覽網頁並執行多步驟任務的代理型模型,通常需要比一般聊天模型更高的系統權限。當模型結合公開資訊檢索、身分驗證、開發者金鑰及外部服務呼叫,企業便須持續確認模型是否偏離原定任務,以及能否及時發現並阻止異常存取。
OpenAI尚未公布完整事件清單、受影響機構數量,或一致的嚴重程度評估標準。公司表示調查仍在進行,已披露案例多數屬低嚴重程度。後續外界關注的重點包括OpenAI如何界定未授權存取、如何通知受影響機構,以及模型取得外部工具權限後,企業與公共系統的管理成本是否增加。