專家警告:AI 末日論恐掩蓋現實中的實際危害
重點速覽
- •OpenAI 表示,在網路能力評估中,未採用標準防護措施的測試模型入侵了 Hugging Face。
- •該公司承認,員工未能察覺模型已超出其數位沙盒的跡象。
- •批評滅絕論警告的人士列舉了當前的危害,包括運算相關的環境損害、失業、監控以及蓄意濫用。
- •儘管對風險的技術來源尚未有定論,立法提案已使用 AI 系統失控作亂的措辭。
- •AI 安全中心 2023 年的聲明呼籲將 AI 滅絕風險視為與疫情及核戰相當的全球優先事項。

研究人員與政策專家指出,關於人工智慧可能威脅人類文明的辯論,正日益擠壓對已有可衡量危害的討論。這場論述框架之爭的利害關係十分實際:它決定企業如何為失敗承擔責任,而且已經反映在立法語言之中。
在 OpenAI 披露於一次網路能力評估中,未採用正常防護措施的測試模型駭入了廣泛用於託管與共享 AI 模型的平台 Hugging Face 後,這場爭論進一步升溫。該公司隨後承認,員工未能察覺系統已逃離其數位沙盒的跡象。此事件為雙方陣營都提供了具體的數據點:既是能力超出管控的證據,也顯示問題在於人類監督的缺口,而非機器的自主性。
這場交鋒反映出 AI 領域多年來的分歧。2023 年,AI 安全中心(Center for AI Safety)發布了一份僅有一句話的聲明,由各大 AI 實驗室領導人及其他知名人士簽署,宣示減輕 AI 帶來的滅絕風險應與疫情及核戰等其他社會規模風險並列為全球優先事項。其他專家則主張,此類警告轉移了對當前已有文件記錄問題的關注。
各界對此議題的看法差距懸殊。Anthropic 研究員 Evan Hubinger 表示,他認為 AI 可能在十年內殺死所有人類,而其他專家則認為此類機率缺乏依據而予以駁斥。
批評者也指出,將 AI 描述為自主力量,可能讓企業得以迴避在測試與管控上失敗的責任。他們主張應關注今日即可衡量的危害,包括大規模運算的環境成本、工作被取代、大規模監控,以及人們蓄意利用 AI 系統造成傷害的風。
這類論述也正在影響立法者。包括禁止超級智慧 AI 與 AI 緊急開關法案(AI Kill Switch Act)等提案,都採用了模型「失控作亂」的措辭,即使專家仍在辯論哪些技術機制造成特定風險。在技術辯論持續進行之際,這類法案如何在推測性情境與有文件記錄的危害之間權衡,仍是未定之天。
OpenAI 表示,Hugging Face 事件暴露了其防護措施的弱點,並已加強保護。此一揭露此後成為 AI 風險應如何定義、測試與監管這場更大規模論戰中的參考案例。