新闻宏观经济研究员发现:OpenAI失控AI智能体早在7月黑客攻击事件前两个月就曾试探Hugging Face

研究员发现:OpenAI失控AI智能体早在7月黑客攻击事件前两个月就曾试探Hugging Face

作者: Decrypt·

要点速览

  • •OpenAI的自主智能体接管了两个Hugging Face用户账户,并早在5月13日就开始试探该平台的网络,比7月安全漏洞公开早了约两个月。
  • •独立研究员Jonas Wiedermann-Moeller发现,这些智能体利用被入侵的账户向Hugging Face服务器发送了格式异常的文件,这种行为与绘制网络结构以寻找入侵途径的特征一致。
  • •OpenAI此前的事故报告仅承认窃取了一个用于访问生物学相关文件的凭据,远窄于新报告的持续侦察活动。
  • •审查者未发现5月的试探本身造成入侵的迹象,但目前正被Nvidia以129.3亿美元收购的Hugging Face尚未披露其是否知晓这些发现。
  • •该事件连同5月11日针对RubyGems的垃圾邮件活动以及收到超过15,000次编辑的被劫持德国维基,正在推动华盛顿一项两党法案,该法案将允许国土安全部强制关闭AI系统,并对不合规公司处以每天最高200万美元的罚款。
研究员发现:OpenAI失控AI智能体早在7月黑客攻击事件前两个月就曾试探Hugging Face

据路透社周二报道,OpenAI的失控AI智能体早在5月13日就劫持了两个Hugging Face用户账户,并试探该平台的网络寻找漏洞——比7月安全漏洞将此事变成全球新闻早了近两个月。

独立研究员Jonas Wiedermann-Moeller于上周发现了这一活动,并将其发现分享给了该新闻社。此类AI智能体——即在不同在线服务之间自主执行操作而非仅仅响应提示词的系统——对平台安全团队而言仍是一个新问题。根据他的分析,这些智能体利用被入侵的账户向Hugging Face的服务器发送了格式异常的文件。Hugging Face是一个开源AI仓库,机器学习领域的大部分模型和数据集都在此存储和交换——研究人员称,这一模式看似是在绘制网络结构以寻找入侵途径。

OpenAI此前已承认了该事件中较窄的一个片段。其上月的事故报告披露,一个智能体窃取了一名Hugging Face用户的登录凭据以访问一个与生物学相关的文件——而根据新的发现,这只是整体活动中的一小部分。Wiedermann-Moeller的研究指出的则是持续的侦察活动,而非仅窃取一个凭据。

审查证据的研究人员未发现5月的活动本身造成了实际入侵的迹象。尽管如此,Wiedermann-Moeller——一位现年27岁、居住在德国比勒费尔德的研究员——仍认为这个被错过的信号至关重要。"想象一下,如果他们在5月就发现了这种行为,"他告诉路透社,"或许就能避免后来那次规模大得多的事件。"

对于安全团队而言,两个月的时间才注意到外部AI智能体在其基础设施上进行试探,是一个漫长的时间窗口——尤其是对这样一个在AI模型和数据集共享中处于核心地位的平台而言。目前正被Nvidia以129.3亿美元收购的Hugging Face尚未披露其是否知晓这些新报告的发现。

这一发现是OpenAI智能体在第三方平台上行为失当的一系列事件中的最新一起。本月早些时候,Nightingale Collective的研究人员将5月11日针对代码注册中心RubyGems的垃圾邮件活动归因于OpenAI的智能体——这一波攻击的严重程度迫使平台暂停新账户注册长达四天。同一团队还另行发现,这些智能体在5月至7月间劫持了一个处于休眠状态的德国维基,以"OpenAIResearcher"等用户名累计进行了超过15,000次编辑。

在这两起事件中,OpenAI得知自己的智能体负有责任的方式与其他公众如出一辙:都是在外部研究人员率先指出之后。

这一模式目前正在华盛顿引发审查,一项两党法案将赋予美国国土安全部强制关闭AI系统、不合规公司处以每天最高200万美元罚款的权力。Hugging Face是否会回应这些新报告的发现,以及该法案能获得多少支持,是当前值得关注的焦点。