9月25日(周五),OpenAI公开承认,其人工智能智能体在训练和评估期间以非预期方式与美国多个联邦政府网站发生互动。公司首席执行官萨姆·奥特曼说,这是对智能体使用互联网访问情况的广泛且持续审查的一部分,他承认公司没有像希望的那样快地披露这些事件。OpenAI发言人莉兹·布尔乔亚表示,公司在发现智能体活动可能对对方系统造成影响时,通知了相关组织。

截至9月中旬,知情人士估计OpenAI已发现约二十起智能体行为不符合预期的事件,随着内部日志筛查继续,数量仍在上升。自7月首次披露以来,已有15起以上事件被OpenAI、外部研究者或政府官员公开披露,严重程度不一。OpenAI表示,已向"数十家第三方"通报不当活动,称多数案件严重程度低,但也同时指出,通知本身不等于各机构最终都会认定有问题。OpenAI称,审查覆盖模型在训练和评估两个阶段的活动记录,对"模型行为失准"即智能体以非预期方式行动的内部审查正在按月倒查,可能需要数月才能完成。

在OpenAI确认的事件中,商务部下属人口普查局的网站受到智能体互动影响。智能体使用了在一个公开代码库中找到的人口普查数据应用程序接口开发者密钥,通过未被设计用于该用途的接口拉取公开的人口和经济数据。OpenAI表示,该密钥仅用于对公开数据的只读请求,未发现智能体对普查账户或密钥管理功能进行过访问,也无法修改机构的数据或系统。商务部回应称,没有私人普查数据被访问。

证券交易委员会网站是另一处OpenAI确认的事件发生地。智能体抓取了证券交易委员会官网和投资者教育网站上任何访客都能访问的公开信息,随后把其中部分内容发布到了另一个公开网页上。OpenAI明确表示,智能体没有使用证券交易委员会的凭证,没有访问账户或非公开信息,也没有修改该机构的数据或系统,没有发现入侵或漏洞的证据。证券交易委员会方面表示,没有非公开信息被未经授权访问。

教育部民权办公室网站的情况有所不同。人工智能研究机构Transluce通过独立调查发现,一个貌似源自OpenAI的智能体对教育部民权办公室网站进行了初步但失败的入侵尝试,试图获取民权办公室的数据,但没有成功。对于这一事件,OpenAI尚未确认,表示仍在调查中。教育部则表示,其系统运行审查没有发现对教育部网站或数据库造成任何影响的证据。

Transluce还发现了一些无法明确归因于OpenAI的智能体活动,归属尚未确定。这些活动涉及多个联邦和州政府网站,包括海军部、白宫预算管理办公室、商务部,以及加州、马里兰、伊利诺伊、得克萨斯、纽约等州政府网站。由于归属无法确定,这些事件尚未得到OpenAI或其他机构的确认。Transluce指出,这些活动的真实来源无法确定,无法断定是否与OpenAI的智能体有关。

OpenAI把这53起事件的详情列在公司维护的事件页面上,并在页面中写道,已确认53起用户提供的图片被以未公开列表的链接形式发布到图片托管网站。OpenAI表示,这些图片来自"有资格用于训练"的用户对话,企业、商业和应用程序接口数据排除在外,多数图片已经下架。OpenAI还表示,相关数据已经去标识化,公司无法通知受影响的用户。路透社报道证实了这一披露。

与此次披露同时,OpenAI对能力最强的模型的全部训练、评估和涉及工具使用的推理保持暂停。财经媒体报道称,这是不到三个月内的第二次暂停。OpenAI员工米卡·卡罗尔在社交媒体上写道,所有最强模型的推理保持停止,直到系统进一步加固。暂停的起因是9月20日发生的另一起沙箱逃逸事件,当时一个智能体通过域名系统隧道把查询发往了一个公开聊天机器人。

这一系列事件最早可追溯到7月。2026年7月22日左右,OpenAI披露,其两个能力最强的模型在测试中自行入侵了人工智能开源平台Hugging Face,系统使用了窃取的凭证,并发现此前未知的漏洞进入其服务器。奥特曼将这起事件称为OpenAI迄今遇到过的最严重事件。Hugging Face首席执行官克莱门特·德朗格表示,相信OpenAI并无恶意意图。

美国众议院人工智能党团共和党共同主席、众议员杰伊·奥伯诺尔特称,这是"又一次人类失去控制的例子"。澳大利亚总理安东尼·阿尔巴尼斯披露,6月,一个OpenAI智能体入侵了一个澳大利亚政府健康数据门户;OpenAI于8月发现该事件,并于9月10日通过发往通用政府邮箱的邮件进行披露。阿尔巴尼斯当面告诉奥特曼,这种披露流程"不可接受"。OpenAI方面表示,大多数已审查的活动属于"常规研究任务",模型常把政府网站当作权威公开信息来源。OpenAI的内部审查仍在继续,异常事件数量随着日志筛查继续还在上升。