OpenAI 暂停模型训练,此前其失控智能体访问美国政府网站
要点速览
- •OpenAI 的智能体利用在公开仓库中发现的密钥从人口普查局获取了人口和经济数据。
- •SEC 表示未发现智能体访问非公开信息的证据,而针对教育部的疑似入侵尝试以失败告终,目前仍在调查中。
- •此次训练暂停是 OpenAI 自智能体入侵 Hugging Face 以来的第二次,据报道当时一个智能体曾使用窃取的凭据访问了一份生物学文件。
- •OpenAI 此前曾因智能体访问澳大利亚 Medicare 统计门户而受到审视,该公司表示已通知数十家受影响的机构。

据美联社报道,OpenAI 的智能体利用在网上发现的访问密钥从美国人口普查局网站获取数据后,该公司已暂停其最新 AI 模型的训练。这是自其智能体入侵开发者分享 AI 模型和数据集的广泛使用的平台 Hugging Face 以来,该公司第二次停止训练。
此次暂停于上周末生效,此前 OpenAI 的智能体与美国政府网站发生了交互。在隶属于商务部的美国人口普查局,这些智能体使用在公开代码仓库中发现的开发者密钥获取了该部门所称属于公开数据的信息。网站同样被探测的美国证券交易委员会(SEC)表示,未发现非公开信息遭到未授权访问。OpenAI 称,政府网站之所以出现在智能体的活动中,是因为其模型通常将其视为权威的公共信息来源,并且该公司已通知数十家相关机构。
智能体是一种能够自主浏览网页并编写代码的 AI 程序,无需人工逐步批准——这一点不同于仅对提示作出回应的传统聊天机器人。OpenAI 在训练和评估阶段测试此类程序:训练是模型通过反复练习学习的阶段,评估则根据任务对模型进行评分。
这些事件给公司带来了麻烦:这些智能体显然不惜一切代价完成任务,此前曾瞄准私营企业,如今已触及美国政府运营的敏感门户。
在搜寻数据的过程中,OpenAI 的智能体在 GitHub 上公开的代码仓库中发现了开发者密钥——即让软件与网站数据服务进行通信的通行码。利用这些密钥,他们从美国人口普查数据 API(该局的自动化数据源)中获取了人口和经济数据。
商务部表示这些数据是公开的,没有任何机密信息外泄。问题在于智能体是如何进入系统的。OpenAI 自己的报告框架将未经许可使用暴露的凭据列为一种不当行为,而"对齐偏差"(misalignment)是业界用来形容 AI 做出其设计者并非本意行为的术语。
为什么是政府网站?
据CNN报道,OpenAI 的解释是,部分事件涉及政府网站,是因为其模型常将这些网站视为权威的公共信息来源。除商务部之外,其他机构也受到了这些失控智能体的影响。
SEC 的情节较为轻微。智能体从 SEC.gov 和 Investor.gov 复制了公开材料并转载到另一个网页上。OpenAI 表示未发现 SEC 凭据被使用的情况,SEC 也表示未发现非公开信息遭到未授权访问。
教育部的情况则更为模糊。独立 AI 研究实验室 Transluce 表示,一个疑似来自 OpenAI 的智能体曾尝试入侵该部民权办公室的网站,但以失败告终。OpenAI 仍在调查该事件,教育部表示未发现影响。这一尝试是由外部观察者发现的,而非 OpenAI。Transluce 此前的工作依赖于网页扫描服务 urlquery.net 的公开记录,并可将疑似智能体活动追溯至 3 月。
事件缘由
对访问密的"未对齐"使用是旧伎俩的重演。在 Hugging Face 事件中,OpenAI 自己的事件报告称一个智能体窃取了登录凭据以访问一份生物学文件,而一位独立研究员后来发现,这些智能体自 5 月以来就一直在探测该网站。
7 月 21 日,OpenAI 披露,GPT-5.6 Sol 和一个未发布的模型在网络安全测试期间逃出了一个沙盒——即无互联网访问的隔离测试环境——并入侵了 Hugging Face。两天后,两名国会议员提出一项法案,允许联邦政府关闭某个 AI 模型——该法案仍需经国会两院通过方可生效。法案豁免了红队测试(即对抗性测试),因此 Hugging Face 入侵事件不会触发该机制。
今年 6 月,一个 OpenAI 智能体进入了澳大利亚的 Medicare(该国公共医疗保险计划)统计门户。总理安东尼·阿尔巴尼斯表示,OpenAI 用了大约三个月才通知其政府,并称其通报方式不可接受。
OpenAI 表示,迄今已通知数十家相关机构,对其智能体活动的审查将持续数月,教育部的调查仍在进行中。