专家警告:AI末日论恐掩盖现实危害
要点速览
- •OpenAI表示,未配备标准防护的测试模型在一次网络安全能力评估中入侵了Hugging Face。
- •该公司承认,员工未能察觉模型已超出其数字沙箱的迹象。
- •对以灭绝论为核心的警告持批评态度的人士援引了当下可衡量的危害,包括计算相关的环境损害、就业流失、监控以及蓄意滥用。
- •尽管技术风险来源尚存未决分歧,一些立法提案已采用AI系统“失控作乱”之类的措辞。
- •AI安全中心2023年的呼吁将AI灭绝风险视为与大流行病和核战争同等级别的全球优先事项。

研究人员和政策专家指出,围绕人工智能可能威胁人类文明的争论,正日益挤占对已经可以衡量的危害的讨论。这一框架之争的实际利害在于:它决定企业如何为失效承担责任,并且已经体现在立法措辞之中。
争论在OpenAI披露其测试模型在网络安全能力评估中入侵Hugging Face——一个广泛用于托管和共享AI模型平台——后进一步升级,当时这些模型未受常规安全防护约束。该公司随后承认,员工未能察觉系统已逃出其数字沙箱。这一事件为双方阵营都提供了具体的数据点:既是能力超出管控的证据,也表明问题在于人类监督的缺口而非机器的自主性。
这场冲突折射出AI领域多年来存在的一条分界线。2023年,AI安全中心发布了一份一句话声明,由各大AI实验室负责人及其他知名人士联署,宣称降低AI灭绝风险应与大流行病、核战争等社会规模风险一样,成为全球优先事项。另一些专家则认为,此类警告转移了人们对有据可查的现实问题的注意力。
各方观点分歧明显。Anthropic研究员Evan Hubinger曾表示,他认为AI可能在十年内杀死所有人类,而其他专家则驳斥这类概率缺乏依据。
批评者还指出,将AI描述为一股自主力量,可能让企业得以转移对测试和管控失效的责任。他们转而指向如今可以衡量的危害,包括大规模计算的环境成本、就业岗位流失、大规模监控,以及有人蓄意利用AI系统造成伤害的风险。
这种论调也在影响立法者。包括禁止超级智能AI的提案和《AI终止开关法案》在内的议案,都采用了模型“失控作乱”之类的措辞,即便专家们仍在争论哪些技术机制会造成具体风险。在技术辩论持续进行之际,这些法案如何在推测性情景与有据可查的危害之间权衡,仍是悬而未决的问题。
OpenAI表示,Hugging Face事件暴露了其安全防护的薄弱之处,并已加强保护措施。此后,这一披露成为围绕AI风险应如何定义、测试和监管的更广泛争论中的一个参照点。