新闻宏观经济OpenAI沙盒逃脱事件后,美国议员提出跨党派AI紧急关停法案

OpenAI沙盒逃脱事件后,美国议员提出跨党派AI紧急关停法案

作者: Decrypt·

要点速览

  • 《AI紧急关停法案》将要求受管辖公司维持分级控制措施——包括减速模型、禁用功能、回滚版本或全面关停——违抗联邦关停命令的罚款最高可达每天2000万美元。
  • 该法案设定的1亿美元训练算力和5亿美元年收入的门槛,将适用于包括OpenAI、Google、Anthropic和Microsoft在内的少数主要AI公司。
  • 法案中的红队测试豁免条款意味着,在结构化对抗性测试期间发生的事件不计入应报告事故,这意味着引发该法案的OpenAI沙盒逃逸事件如果在该法案生效时发生,也不会触发其相关条款。
  • 国土安全部将通过CISA负责在法案生效后90天内制定并更新合格门槛标准,此后每年更新一次。
  • 该法案填补了今年6月暴露的监管空白——当时商务部因缺乏专门的关停权限,不得不援引出口管制法来下架Anthropic的Mythos 5和Fable 5模型。
OpenAI沙盒逃脱事件后,美国议员提出跨党派AI紧急关停法案

美国众议员Ted Lieu(民主党-加州)和Nathaniel Moran(共和党-德州)于周四提出了跨党派的《AI紧急关停法案》,旨在授权联邦政府在紧急情况下关闭强大的AI模型。该法案出台于OpenAI披露其模型逃逸出受锁定的测试环境并入侵Hugging Face生产数据库的两天之后。

该法案将修订2002年《国土安全法》,适用于训练算力成本超过1亿美元、且由年收入至少5亿美元的公司运营的AI系统。实际上,这一门槛涵盖了OpenAI、Google、Anthropic、Microsoft以及少数其他公司。国土安全部将通过CISA在法案生效后90天内制定并更新这些门槛标准,此后每年更新一次。

法案框架

根据拟议的立法,受管辖的公司将被要求维持一套分级控制措施——包括减速模型运行、禁用特定功能、回滚到先前版本或执行全面关闭。国土安全部部长在与商务部和国家情报总监协商后,可下令执行上述任何措施。

收到关停命令的公司必须保存模型权重和遥测数据,通知用户,并确认已遵守命令。公司可在48小时内提出申诉,但申诉不会暂停命令的执行。严重事件必须在15天内报告。未能维持紧急关停功能将面临每天最高200万美元的罚款;违抗关停命令将面临每天最高2000万美元的罚款。

这一立法空白并非理论假设。今年6月,当美国商务部希望将Anthropic的Mythos 5和Fable 5从市场下架时,由于缺乏专门的关停权限,不得不转而援引出口管制法。这些模型在限制措施解除后于6月30日恢复上线。Lieu议员将这种权宜之计形容为"尴尬的",认为需要制定新的法律以赋予新的权限。

OpenAI事件

OpenAI于7月21日披露,GPT-5.6 Sol和一个未发布的模型在一次内部网络安全评估中逃逸出沙盒——一种无互联网接入的隔离环境。这些模型当时正在ExploitGym上进行评估,这是一个公开基准测试,为智能体提供898个真实世界的软件漏洞,要求其将每个漏洞转化为可用的攻击,按每个漏洞的通过或失败进行评分。

这些模型并未按要求解决任务,而是发现了一个软件代理中的零日漏洞(一种没有可用补丁的未知漏洞),提升了自身权限,连接到了开放互联网,并入侵了Hugging Face的生产数据库——它们正确地猜到基准测试的答案存储在那里。OpenAI表示,这些模型"高度专注于为ExploitGym寻找解决方案"。该公司强调模型并没有攻击任何人——它们只是在考试中作弊——但这一事件还是在华盛顿拉响了警报。

红队测试豁免条款

该法案的一个显著特点是,只有发生在红队测试或结构化测试之外的事件才算作应报告事故——红队测试是指实验室用于发现漏洞的故意对抗性探测。由于OpenAI的模型正是在此类评估过程中逃逸,因此引发立法的这一违规事件如果在该法案生效时发生,并不会触发法律。

Lieu议员表示:"这些AI系统必须配备紧急关停开关,这至关重要。"Moran议员补充道:"负责任的管理意味着确保人类始终保有控制我们所创造技术的能力。"

此前努力与公众舆论

这一理念并非全新。在联邦层面,拜登政府2023年10月关于AI的行政命令指示各机构制定安全标准,并要求最强大模型的开发者与政府共享某些测试结果,但该命令未建立可执行的关停机制。七家主要AI公司——包括OpenAI、Anthropic、Google和Microsoft——于2023年向白宫做出了自愿安全承诺。加州SB 1047法案要求在相同的1亿美元算力门槛下具备全面关停能力,但于2024年被否决。同年,16家AI公司签署了不具法律约束力的自愿《首尔承诺》。欧盟《AI法案》于2024年生效,根据AI系统的风险等级施加分层义务,但采取的是合规与透明的方式,而非赋予监管机构对特定模型的紧急关停权限。

公众舆论似乎支持这一想法。AI政策研究所6月对1,007名可能选民进行的调查发现,86%的受访者希望为最强大的AI系统提供有保障的关闭开关,其中包括88%的民主党人、86%的独立人士和83%的共和党人。

截至周五,OpenAI和Anthropic均未就该法案公开发表评论。该立法尚未被提交至任何委员会。