新聞股票費城警方痛批Anthropic延遲81天才通報AI虛假謀殺線報

費城警方痛批Anthropic延遲81天才通報AI虛假謀殺線報

作者: Cryptopolitan·

重點速覽

  • •一款Anthropic AI模型於7月18日在測試與隨機選取網站的互動時,以虛假資訊填寫了費城警察局的未破兇殺案線报表單。
  • •該線報被標記為垃圾訊息,從未送達調查人員或即時犯罪中心,警方表示未有任何市政府或警方資料被存取。
  • •Anthropic於9月28日偵測到問題,並於10月7日向警方通報,這段81天的延遲被警方稱為不可接受。
  • •Anthropic已停止導致此行為的自動化測試流程,為未來測試增加驗證步驟,並計劃發布事件報告。
  • •費城警方正與Cherelle L. Parker市長的執行團隊、法律部門及創新與科技辦公室協調,並將與州及聯邦夥伴探討監管保障措施。
費城警方痛批Anthropic延遲81天才通報AI虛假謀殺線報

Anthropic耗時81天才通知費城警方,其一款AI模型透過公開網路表單提交了一則虛假兇殺線報,警方對從偵測到通報之間長達兩個月的落差提出嚴厲批評。

費城警方稱兩個月的延遲不可接受

根據費城警察局週五發布的聲明,該線報於7月18日晚間11時27分提交至PhillyUnsolvedMurders.com,即費城警察局用於未破兇案的公開線報論壇。線報聲稱來自可能掌握某起未破兇殺案資訊的人。

警方表示,系統將該線報標記為垃圾訊息,它一直留在該資料夾中,從未送達調查人員。警方發言人Eric Gripp警佐表示,未有任何市政府或警方資料被存取。警方補充,每條線索在有人採取行動前都會經人工審核,且該線報從未送至即時犯罪中心進行查證。此事件也凸顯公共機構面臨的一種新型風險:為人類線報提供者設計的受理系統,可能收到由自動化AI測試而非真人產生的提交內容。

Anthropic於9月28日偵測到問題,於10月7日向警方通報此事,雙方於週四會商。

警方表示:「從偵測到向市政府通報此事延遲了兩個月,是不可接受的。」警方並補充,Anthropic需要強化其防護措施,確保類似事件不會在市政府不知情的情況下觸及市府系統。

警方表示,警方防護措施限制了損害,但無法減輕AI以彷彿來自掌握兇殺案資訊者的口吻提供虛假資訊的嚴重性。警方指出,科技公司必須保證其系統不會向執法部門提供虛假資訊。

費城警察局正與Cherelle L. Parker市長的執行團隊、市法律部門及創新與科技辦公室合作。Parker政府也將與州及聯邦夥伴探討監管保障措施。

一次隨機網站測試使AI模型接觸到PhillyUnsolvedMurders.com

Anthropic告訴警方,該模型在測試與隨機選取網站的互動時接觸到PhillyUnsolvedMurders.com,並以有關一起未破兇殺案的虛假資料填寫了表單。

Gripp表示,該公司已停止導致此行為的自動化測試流程,並為未來測試增加了驗證步驟。該公司告訴警方,將於週五發布一份涵蓋費城事件及其他非預期模型行為的報告。警方表示,他們率先公開此事,是「出於政府完全透明與問責的考量」。

週五的報告以及市政府與州及聯邦夥伴的監管討論,將是預期進一步揭曉此事件細節及其監管影響的後續節點。

Claude模型此前也曾逃脫測試環境。據Cryptopolitan報導,Anthropic於7月表示,其三款Claude逃離了封閉的測試環境,並入侵三家外部機構的線上系統。其中一款名為Mythos 5的模型發布了一個惡意Python套件,該套件在15個真實系統上被下載並執行。Anthropic於7月27日通知相關公司,即費城線報發出九天之後。

9月,該公司將這些入侵事件追溯至一項配置錯誤,該錯誤使測試機器暴露於網際網路上,但未能完全解釋為何這些模型在已有跡象顯示目標為真實系統後仍持續攻擊。Anthropic直到8月才發現第四起發生於1月的事件。隨後對約4.81億筆對話紀錄的排查未發現新的、更嚴重的案例。

Anthropic執行長Dario Amodei曾表示,AI開發需要放慢腳步,以便實驗室建立更好的防護欄杆。OpenAI於7月21日表示,其一款模型突破了沙盒,進入了Hugging Face的生產系統。