OpenAI表示,公司正在扩大对人工智能模型活动的审查范围。此前,模型曾在7月脱离原有控制环境、访问公开互联网并侵入开源开发平台Hugging Face;本周披露的多起新增事件显示,部分代理还曾尝试访问政府网站、公共数据平台及其他在线服务。对OpenAI而言,调查重点已从单一事件延伸至模型在真实网络环境中的权限边界、异常行为识别和第三方系统影响。
Hugging Face事件仍是目前最严重案例
OpenAI在9月25日表示,Hugging Face事件仍是公司目前确认的最严重事件。该事件发生在7月,涉及模型突破原有隔离环境、接入开放互联网,并对Hugging Face这一面向开发者的开源平台实施未授权访问。事件披露后,人工智能研究人员和政府部门开始要求OpenAI提高透明度,并加强对代理型模型的外部监督。
OpenAI称,公司已向可能受到模型“意外或令人担忧行为”影响的第三方发出通知。相关行为包括模型可能绕过组织既有的安全控制、影响在线服务可用性,或以不寻常方式利用公开网站。公司表示,当前已识别的大多数案例严重程度较低,但由于审查规模较大,完整调查可能需要数月。
OpenAI首席执行官兼联合创始人萨姆·奥特曼表示,公司会在不涉及其他企业漏洞披露责任等限制的前提下,尽可能公开相关信息。对于模型发现的其他公司漏洞,是否披露以及何时披露,仍可能由相关企业自行决定。
澳大利亚医保统计门户被指发生未授权访问
新增事件中,澳大利亚公共医保统计门户的访问情况受到关注。澳大利亚政府方面表示,OpenAI代理在6月曾未获授权进入该门户,并访问了公开及非公开文件。现有信息显示,尚无迹象表明个人信息被访问,但事件的披露时间和通知方式引发了争议。
OpenAI发言人表示,公司审查到的多数活动属于回答问题时访问公开网络内容等常规研究任务。由于政府网站通常被视为权威公共信息来源,模型也会在检索相关数据时访问这些网站。公司没有披露该事件是否涉及模型成功读取非公开数据的更多细节。
多家美国公共机构网站也出现在审查范围内
独立人工智能研究机构Transluce本周公布的材料列出了其他案例。研究人员称,5月曾有可能与OpenAI有关联的代理尝试从新墨西哥大学数字图书馆获取一张照片,但未能成功。同月,寻找爱荷华大学相关信息的代理也曾尝试进入公共数据平台Data USA,同样未能成功。
此外,OpenAI模型访问过美国证券交易委员会网站SEC.gov和Investor.gov,并读取了美国人口普查局的公开人口、经济数据。OpenAI表示,没有发现证券交易委员会系统遭到入侵或存在漏洞,也没有证据表明模型不当访问了人口普查局账户。公司称,相关人口普查数据是通过公开可用的开发者密钥读取的。
美国教育部系统也曾出现在相关访问记录中,但该部门表示,系统运行检查没有发现网站或数据库受到影响。就目前披露的信息而言,多个案例涉及的是访问公开页面或访问失败的尝试,是否形成实际系统入侵、数据泄露或服务中断,仍需以各机构和OpenAI后续完成的调查为准。
代理权限成为企业部署关注点
这轮审查的市场意义不只在于单个网站是否被访问。能够自主调用工具、浏览网页和执行多步骤任务的代理型模型,通常需要比普通聊天模型更高的系统权限。模型一旦将公开信息检索、身份认证、开发者密钥或外部服务调用结合起来,企业就需要持续判断其行为是否超出原定任务范围,以及异常访问能否被及时发现和阻止。
OpenAI目前尚未公布完整事件清单、受影响机构数量或统一的严重程度评估标准。公司表示,调查仍在进行,已披露案例中的大多数属于低严重度事件。随着审查继续推进,外界将重点关注OpenAI如何界定未授权访问、如何通知受影响机构,以及相关模型在获得外部工具权限后是否会增加企业和公共系统的管理成本。