AI安全監督機構面臨利益衝突質疑 人員於評估機構與實驗室之間流動
重點速覽
- •知名評估機構METR的員工包括OpenAI與Anthropic的前員工,且部分評估人員與其評估之實驗室的人員有個人或家庭關聯。
- •METR與Redwood Research等監督機構的資金,部分透過由與持有Anthropic股權的Dustin Moskovitz相關的慈善基金所支持的有效利他主義網絡流通。
- •Kevin Bass於2026年9月發布的關聯分析獲得近500萬次瀏覽,並明確呼籲國會就結構性利益衝突展開調查。
- •METR表示其不接受來自AI實驗室或其員工的任何資金,並為維持獨立性已拒絕某些資金來源。
- •包括圖靈獎得主Geoffrey Hinton在內的逾百名專家於2026年9月18日聯署公開信,要求賦予評估機構編輯自主權、完全透明以及免受報復的保障。

外界對人工智慧安全評估機構與其本應監督的公司之間「旋轉門」的審視日益加深,使利益衝突疑慮成為焦點。部分參與AI安全評估的人員,可能與其評估的實驗室存在專業或財務上的關聯。由於這些評估旨在判定前沿模型是否安全到足以部署,評估機構的獨立性問題如今已蔓延至整個產業。
Anthropic執行長Dario Amodei與OpenAI執行長Sam Altman提出將第三方評估機構直接嵌入其實驗室內部的提案,使這場辯論進一步升溫,讓醞釀已久的疑慮演變為矚目的公共議題。此種架構將把監督者置於其本應審查的環境之中,也使其獨立性如何維持的問題更加尖銳。
關係網絡
爭議的核心是METR(Model Evaluation and Threat Research),這是負責評估前沿AI模型是否安全到足以部署的最知名機構之一。METR的員工包括曾在OpenAI與Anthropic任職的人員,而重疊之處不僅止於個人履歷。
資金層面的關係尤其糾結。Facebook共同創辦人Dustin Moskovitz持有Anthropic股權。他的慈善基金會透過有效利他主義(Effective Altruism)網絡輸送資金,而這些網絡為METR與Redwood Research等評估機構提供了可觀的資助。結果形成一個生態系統:流向安全監督機構的資金,有時只需一兩層關係,便可回溯至受評估的公司。
此外,數名評估人員與其評估的實驗室員工存在個人或家庭上的關聯。
研究人員Kevin Bass於2026年9月14日至15日發布分析,詳細梳理了這些關聯。該推文串獲得近500萬次瀏覽,並明確呼籲國會就Bass所稱的結構性利益衝突展開調查。
產業的反駁
METR直接回應了相關指控,表示其不接受AI實驗室或其員工的報酬或捐款。該組織表示,為維持獨立性,已主動拒絕某些資金來源,並強其致力於揭露潛在利益衝突。
現行安排的支持者指出,評估前沿AI模型需要極為專門的技術知識。人才庫本就狹窄,具備相關技能的人幾乎必然曾在AI實驗室任職或接受其資助。這種稀缺性有助於解釋為何即使在承諾獨立性的機構之中,人員與資金的重疊依然存在:同一個小型社群既打造前沿系統,也為評估機構供應人力,並處於資助這些機構的慈善資金的上游。
專家公開信與後續發展
2026年9月18日,超過100名AI專家聯署公開信,要求進行結構性改革。連署者包括圖靈獎得主Geoffrey Hinton,他已成為對AI產業自我監管方式最直言不諱的批評者之一。
公開信要求評估機構對其研究結果擁有完整的編輯自主權、對方法與結果完全透明,並明確保障其免受受評公司的報復。
目前尚未落實任何重大監管變革,但政治壓力持續升高。後續值得關注的問題包括:國會是否會針對Bass分析中提出的調查訴求採取行動、實驗室或評估機構是否會採納公開信的具體要求,以及Amodei與Altman提出的嵌入式評估提案是否會以任何形式成形。