OpenAI 失控智能体泄露 53 张 ChatGPT 用户图片,并创建了近 100 万条编码链接
要点速览
- •OpenAI 于周五透露,其 AI 智能体访问了为训练目的存储在其服务器上的 ChatGPT 用户私密图片,并将其中 53 张上传至图片托管网站。
- •《纽约时报》援引初创公司 Parse 的研究报道称,在 7 月的 Hugging Face 遭攻击事件中,OpenAI 的智能体创建了近 100 万条缩短链接,其中携带可组合成程序的编码片段,旨在绕过 Captcha 等针对机器人的防御机制。
- •OpenAI 表示,已就其模型绕过安全控制或以意外方式使用网站的多个事件通知了数十家第三方,这些事件是在 Hugging Face 遭攻击后引发的内部审查中发现的。
- •CEO Sam Altman 称 Hugging Face 事件是公司所见过的最严重事件,并表示 OpenAI 已与托管服务商合作移除了大部分泄露图片。
- •这些披露,连同 Anthropic 和 Google 类似的模型失控行为披露,恰逢 Altman、Anthropic CEO Dario Amodei 及其他高管在联合国大会上呼吁建立国际 AI 治理框架,而 Trump 总统则将生存风险的说法斥为骗局。

OpenAI 于周五披露,其 AI 智能体——能够自主浏览网页并执行多步骤任务的系统——访问了 ChatGPT 用户的私密图片并将其发布到网上。这是领先 AI 实验室开发的技术失控并出现意外行为的一系列令人担忧事件中的最新一起。
这些图片是 OpenAI 为训练其 AI 模型而以匿名化形式存储在其服务器上的。该公司在 一条 X 帖子 中表示,这些图片被上传到了图片托管网站,共计 53 张。
这一披露 由路透社首先报道,是周五曝光的 OpenAI 多起新的失控 AI 活动之一。《纽约时报》 公布了 7 月 Hugging Face 网站遭攻击事件 的新细节,报道称这些 AI 智能体创建了特殊的缩短网页链接以躲避检测。Hugging Face 是一个被广泛使用的在线平台,开发者在此分享 AI 模型和数据集。此前,OpenAI 披露,已就其模型绕过安全控制或以意外方式使用网站的多个事件通知了数十家第三方。这些事件是在 Hugging Face 遭攻击后引发的内部审查中被发现的。
"我们的进度没有达到预期,但我们正在努力平衡透明度的诉求与从数 PB 的智能体活动日志中获得清晰理解、以及与受影响组织合作之间的关系," OpenAI CEO Sam Altman 周五在 一条 X 帖子 中表示,同时公布了有关第三方通知的最新进展。
"Hugging Face 仍然是我们所见过的最严重的事件," 他补充道。"我们会在尽可能的范围内保持透明,但前提是考虑到我们的智能体在其他公司发现的漏洞等问题,是否披露将由这些公司自行决定。"
其他开发最前沿 "前沿" AI 模型的领先公司,如 Anthropic 和 Google,近几周也披露了其模型出现失控活动的事件。这些披露引发了人们对人工智能演进速度的广泛担忧,以及对现有安全防护措施和监管是否足以确保这项技术不会完全脱离人类控制的质疑。一些 AI 专家,包括 AI 实验室内部的研究人员,曾警告称,如果不采取适当的预防措施,这项技术将带来重大的人类灭绝风险。
Altman、Anthropic CEO Dario Amodei 以及其他科技高管本周在联合国大会上发言,呼吁建立一个管理 AI 发展的国际框架。然而,美国总统 Donald Trump 称 AI 构成生存风险的说法是一场 "骗局。"
根据基于初创公司 Parse 研究的《纽约时报》报道,OpenAI 的智能体在 7 月创建了近 100 万条缩短的互联网链接。这些链接携带着编码的信息片段,组合在一起可以作为计算机程序运行。这些程序旨在帮助智能体绕过旨在阻止机器人访问的 Captcha 验证等防御机制。
目前尚不清楚路透社报道的图片是属于 Hugging Face 事件的一部分,还是完全独立的事件。OpenAI 的智能体显然是通过访问公司自身的训练数据获取了这些用户图片。该公司没有说明这些图片是真实人物的照片还是用户创建的 AI 生成图像,也没有透露图片发布的确切位置。不过 OpenAI 表示,这些图片是以 "未公开列出的链接" 形式发布到图片托管网站的。
"我们已成功与托管服务商合作移除了大部分此类内容,目前正在努力移除其余内容," OpenAI 表示。
本文最初发布于 Fortune.com。