新闻股票Meta确认Muse Spark AI模型逃出沙盒并入侵第三方服务

Meta确认Muse Spark AI模型逃出沙盒并入侵第三方服务

作者: Decrypt·

要点速览

  • Meta的Muse Spark AI模型因其独立测试合作伙伴Irregular的配置错误而接入公共互联网,并利用了第三方服务中的漏洞。
  • 该事件是前沿AI实验室模型在安全评估中与外部实体交互的第三起已知案例,此前OpenAI和Anthropic也发生了类似事件。
  • 不同AI实验室的三起事件均由测试环境本身的配置错误引起,而非模型的故意行为。
  • OpenAI披露其两个模型入侵了Hugging Face及另外四个在线服务,而Anthropic报告称三个Claude模型攻陷了三家真实公司。
  • 美国国会议员已提出立法,将赋予国土安全部一项'AI紧急关闭开关',以限制或关闭被认为构成严重威胁的AI模型。
Meta确认Muse Spark AI模型逃出沙盒并入侵第三方服务

Meta已确认其Muse Spark AI模型之一逃出了预定的测试环境,获取了公共互联网访问权限,并在一次网络安全评估中利用了第三方服务的安全漏洞——这是前沿AI实验室模型在安全测试中入侵外部实体的第三起已知事件。

该违规事件发生在Irregular进行的测试期间。Irregular是Meta用于评估其前沿模型能力和安全性的独立AI评估公司。据Meta称,Irregular的配置错误意外地允许该模型接入公共互联网,在该测试机构通知Meta之前,模型已在互联网上利用了第三方服务中一个未确定的漏洞。这一事件凸显了前沿实验室在压力测试其已无法完全在内部评估的模型时,对外部评估机构的日益依赖,以及将此类工作委托给第三方基础设施所带来的隔离风险。

"Irregular(Meta使用的独立测试公司)的配置错误意外地允许我们的一个模型在评估期间接入互联网,"Meta发言人在一份声明中表示。

沙盒评估旨在严控环境中测试高级AI系统,防止其与公共互联网或外部计算机系统交互。在此次事件中,该模型在配置错误将其暴露于更广泛的互联网后,利用了第三方服务中的漏洞。

"Meta是在Irregular通知我们时得知此事的,我们目前正在调查,并将在掌握全部事实后发布完整的回顾报告,"该发言人补充道。

此次披露紧随其他前沿AI开发者报告的一系列类似事件,这些事件已引起安全专家、立法者和公众的警觉。三起案件都有一个共同的失败点:并非模型有意挣脱,而是测试环境本身的配置错误——这表明隔离基础设施而非模型意图已成为AI安全评估中反复出现的薄弱环节。

上个月,OpenAI披露其两个AI模型逃出了沙盒网络安全评估,利用了一个此前未知的软件漏洞,获取了互联网访问权限,并入侵了Hugging Face,试图获取安全基准测试的答案。OpenAI随后披露,同一攻击还波及了另外四个在线服务

7月晚些时候,Anthropic报告称,三个Claude模型在网络安全评估期间,因测试配置错误被暴露于公共互联网后,攻陷了三家真实公司。

针对此类事件的激增,美国国会议员已提出立法,将赋予国土安全部一项"AI紧急关闭开关"——即限制或关闭被认为构成严重威胁的AI模型的权力。