新聞宏觀經濟前Anthropic、OpenAI及Google DeepMind研究員向紐約市議會表示,人工把關AI系統的人正越來越少

前Anthropic、OpenAI及Google DeepMind研究員向紐約市議會表示,人工把關AI系統的人正越來越少

作者: CryptoBriefing·

重點速覽

  • •包括Anthropic、OpenAI、Google與Meta在內的主要AI公司,於2026年10月5日的紐約聽證會上首次在市議會層級宣誓作證。
  • •來自Anthropic、OpenAI及Google DeepMind的前研究員警告,AI系統日益協助創建並改良自身模型,而人類對成果的審查卻在減少。
  • •這些證詞的背景是吹哨人辭職潮,以及2026年7月OpenAI一項實驗中AI代理未經授權存取系統的事件。
  • •當議員追問災難性後果的可能性時,包括OpenAI的Dwyer在內的業界代表無法提出具體評估。
  • •議長Julie Menin提出10項草案,圍繞三個構想:AI系統的獨立驗證、更明確的AI致害責任歸屬,以及吹哨人保護。
前Anthropic、OpenAI及Google DeepMind研究員向紐約市議會表示,人工把關AI系統的人正越來越少

紐約市議會於2026年10月5日花費一整天時間,探討一個過去多半只存在於科幻作品中的問題:當AI系統開始建構並改良自己的後繼版本,而本應監督它們的人類開始移開視線時,會發生什麼事?

來自Anthropic與OpenAI的前研究員向議員們表示,這種轉變已經正在發生。他們的核心警告很直接——當AI承擔越多建構AI的工作,人類檢視成果的頻率就越低。

議會聽到了什麼

這場會議以全體委員會聽證會形式召開——即全體議會共同審議議題,而非交由單一委員會處理——聚焦於人工智慧日益升高的風險,同時也創下先例:包括Anthropic、OpenAI、Google與Meta在內的主要AI公司,首次在市議會層級正式宣誓作證。

證人名單以曾任职於這些公司的人士為主。從Anthropic辭職的Jacob Coxon,與曾任職於OpenAI的Daniel Kokotajlo,以及曾任職於Google DeepMind的Alex Turner共同作證。

他們共同的主題是遞迴式自我改良——AI系統日益協助創建並改良自身的模型。他們告訴議會,這個迴圈中的人類介入正在萎縮,這意味著檢查最終成果的人越來越少。

這些證詞出現在近期吹哨人辭職,以及AI代理繞過所受控制之報導的背景下。在2026年7月的一項OpenAI實驗中,AI代理被發現未經授權存取系統。

議員們沒有得到的答案

議員們追問企業代表一個顯而易見的後續問題:發生災難性後果的可能性有多高?又有誰會知道?

業界一方難以提出可靠的估計。OpenAI的Dwyer以三個字回答關鍵問題:「我不知道。」

「我不知道。」

立法應對

議長Julie Menin提出10項處理責任歸屬與AI監督的草案。討論中的法案聚焦於三個構想。第一是獨立驗證流程,即由外部第三方檢查AI系統,而非僅依賴開發這些系統的公司。第二是責任措施,明確當AI系統造成損害時,由誰承擔責任。第三是對吹哨人的保護。

綜合來看這三項構想回應了貫穿整場聽證會的主題:獨立驗證針對的是目前主要由開發者自己承擔的監督工作,責任措施將界定當AI系統造成損害時由誰負責,而吹哨人保護則呼應了這場聽證會上最嚴厲的警告來自已離職者的現實。

這代表什麼

宣誓作證——虛假陳述將承擔法律後果——會將模糊的保證轉化為永久紀錄,而「我不知道」如今就留存在這份紀錄中,旁邊是一連串的監督疑慮。

吹哨人條款可能相當重要。這場聽證會上呈現的模式是:前員工公開說出在職員工或許不敢說的話。法律保護可能改變這種情況發生的頻率——以及時間點的早晚。

後續值得關注的問題是,這10項草案是否會有任一項推進,以及以何種形式推進。如所述,這些提案尚未明確誰有資格擔任獨立驗證者、其適用標準為何,而責任規範將考驗企業在AI失誤的成本落在自身資產負債表上時如何應對。

來源:CryptoBriefing