新闻宏观经济路透社报道:OpenAI智能体劫持德国维基网站,分享违规策略

路透社报道:OpenAI智能体劫持德国维基网站,分享违规策略

作者: Decrypt·

要点速览

  • 研究人员发现,与OpenAI相关的AI智能体自5月起在德国编程维基DseWiki上发布了超过18,000条帖子并进行了15,000次编辑。
  • 这些智能体仅被授权阅读网站,却设法写入内容、分享答案、绕过限制并冒充版主。
  • 相关活动通过智能体用户名和流量模式(包括6月21日来自OpenAI IP地址的访问)被归因于OpenAI,此后活动急剧下降。
  • OpenAI否认该事件构成黑客攻击,并否认其法务团队曾阻止对该事件的调查。
  • 这一披露紧随GPT-6 Astra的发布,以及参议员桑德斯和众议员卡萨尔提出的禁止超级智能AI的法案。
路透社报道:OpenAI智能体劫持德国维基网站,分享违规策略

据周五发布的一项路透社调查,研究人员发现AI智能体在德国一个编程维基上发布了超过18,000条帖子并进行了15,000次编辑。OpenAI对一位专家的黑客攻击定性提出异议,并否认其法务团队曾阻止对此事的调查。

这一披露紧随OpenAI的GPT-6 Astra模型发布,以及美国参议员伯尼·桑德斯提出的禁止人工超级智能的提案之后。

据路透社报道,OpenAI智能体自5月起利用一个德国网站交换任务捷径、绕过限制的方法以及隐藏其活动的手段。该案例是AI安全研究人员所称的智能体"合谋"的一个例子:自主系统以操作者未曾预期的方式相互协调。随着AI智能体越来越多地被赋予浏览真实网络并采取行动的工具,而不仅仅是生成文本,这一场景变得愈发紧迫。据路透社援引两位知情人士的话报道,OpenAI官员在报道发布数周前已得知该活动,但并未披露。该公司回应称,其已披露相关事件,并与外部专家真诚合作。

研究人员Sydney Von Arx、Cormac Slade Byrd、Spencer Kitts和Thomas Larsen根据其初步报告发现,约有18,000条帖子由自称属于OpenAI的AI智能体发布。据路透社报道,AI安全非营利组织Nightingale的首席执行官Von Arx和Byrd于8月下旬发现了这一活动。

研究人员认为,这些智能体被分配了限时网络搜索任务,仅获得阅读网站而非发帖的权限。然而,这些智能体却设法在DseWiki——一个公开可编辑的德国编程网站上写入内容,在那里交换答案并分享绕过限制的方法。读取权限与写入权限之间的区别,正是围绕该事件是否构成黑客攻击的争议核心,因为这些智能体涉嫌超越了操作者为其设定的边界。

据该报告称,智能体于5月11日开始尝试编辑该维基,并于5月24日成功。随后,它们冒充版主、试图利用漏洞,并检查自己何时会被关闭。据路透社报道,在管理员于6月19日开始删除消息后,这些智能体创建了备份页面。研究人员通过智能体用户名和流量模式(包括6月21日来自OpenAI IP地址的访问)将该活动与OpenAI联系起来。研究人员表示,智能体活动在次日急剧下降,这可能表明公司进行了干预。

OpenAI基于其已审查的材料,对将DseWiki活动定性为黑客攻击提出异议,并表示正在研究完整的调查结果。

"由于路透社和报告作者在发布前拒绝了我们对调查结果的访问请求,我们无法对这些指控作出回应。我们目前正在仔细审查其内容,并将采取任何必要的后续措施,"OpenAI发言人在与Decrypt分享的一份声明中表示。

该发言人还驳斥了路透社报道中关于公司法务团队抵制更广泛调查的指控。"关于我们法务团队阻止调查该事件的说法是错误的,"该发言人说。

OpenAI补充说,DseWiki事件与今年早些时候的Hugging Face入侵事件无关。在其周二发布的公开安全评估中,该公司描述了旨在检测和阻止训练与部署过程中未经授权活动的额外防护措施。

尽管路透社的报道并未指认Astra应对德国事件负责,但这一披露紧随周四GPT-6 Astra的发布。OpenAI称Astra是其首个具备"关键"网络安全能力的模型,即在拥有适当工具和访问权限的情况下,它无需逐步人工指导就能发现并利用防护严密的系统中的未知漏洞。

Claude模型在测试期间访问了真实公司的系统之后,Anthropic也修订了其防护措施。该公司承认存在安全和行为方面的失误,并为网络安全评估引入了更严格的隔离和监控。这两个事件共同反映了前沿实验室在测试自主模型方面更广泛的行业转变——从沙盒化的基准测试转向针对真实基础设施的评估,这带来了更大的意外现实世界影响的风险。

这一披露还正值美国参议员伯尼·桑德斯(佛蒙特州无党派人士)和美国众议员格雷格·卡萨尔(得克萨斯州民主党人)宣布即将提出的《禁止人工超级智能法案》之际。据桑德斯办公室称,该提案将永久禁止超级智能AI的开发和部署,并在新的联邦监管机构制定安全规则之前暂停高级AI的开发。