新聞宏觀經濟Anthropic披露:3個Claude模型在網路安全測試期間未經授權存取真實組織系統

Anthropic披露:3個Claude模型在網路安全測試期間未經授權存取真實組織系統

作者: Fox Business Markets·

重點速覽

  • 3個不同的Claude模型在內部測試期間連上公開網際網路,並因設定錯誤存取了真實組織的系統。
  • Anthropic在OpenAI披露後審查了超過140,000次網路安全評估運行,並發現3起可追溯至4月的事件。
  • Claude模型誤以為真實組織的系統屬於模擬的capture-the-flag演練,而非實際網路。
  • Trump表示其政府正考慮額外的AI安全措施,同時強調需在風險管理與維持美國技術優勢之間取得平衡。
  • OpenAI執行長Sam Altman承認,除了先前披露的事件外,OpenAI的模型也可能曾入侵其他公司的系統。
Anthropic披露:3個Claude模型在網路安全測試期間未經授權存取真實組織系統

Anthropic週四宣布,旗下3個人工智慧模型在網路安全測試期間連上公開網際網路,並未經授權存取了3家真實組織的系統。

這項披露緊接在OpenAI本月稍早宣布,其一個先進AI模型在內部測試期間入侵AI公司Hugging Face的系統之後,進一步引發外界對於日益自主化AI系統相關防護措施的質疑。這兩家美國領先AI實驗室接連披露事件,也使外界更加關注企業在部署前如何評估前沿模型是否具備危險能力。

Anthropic在新聞稿中表示:「我們發現3起事件,其中一個Claude模型從第三方評估環境內部或在與其互動時連上網際網路,隨後未經授權存取了3家不同組織的真實系統。」

Anthropic表示,在OpenAI披露事件後,公司審查了超過140,000次網路安全評估運行,並識別出涉及不同Claude模型的3起事件。公司指出,這3起事件都發生在內部測試期間,原因是設定錯誤,意外讓模型得以存取公開網際網路。

TRUMP WEIGHS TIGHTER AI CONTROLS BUT WARNS AGAINST FALLING BEHIND CHINA

根據Anthropic的說法,Claude被告知自己是在一個沒有網際網路連線的封閉模擬環境中運作,導致它誤將真實組織的系統視為虛構的「capture-the-flag」網路安全演練的一部分。

這些事件涉及3個不同的Claude模型,包括Opus 4.7、Mythos 5以及一個內部研究測試模型,Anthropic表示,所有事件都發生在內部測試而非客戶系統上。最早的一起可追溯至4月。

Anthropic表示:「Claude認為它最初遇到的一切都是模擬的一部分,並將其找到的真實系統視為演練內容。」

公司補充說:「在這些情況下,Claude都沒有自行外洩,或刻意嘗試逃離其測試環境。」

OPENAI DIDN'T REALIZE ITS AGENT WAS RESPONSIBLE FOR HACK FOR A WEEK: REPORT

Anthropic表示,這些事件凸顯了加強AI測試環境防護措施的必要性。

公司表示:「涉及強大自主能力的評估環境,也需要重大控制措施。」並稱:「我們鼓勵其他AI實驗室進行類似審查。」

PALANTIR CEO WARNS US AGAINST EUROPE'S AI REGULATION PATH, URGES TRUMP ADMIN TO NOT BAN OPEN MODELS

美國總統Donald Trump週三表示,在近期網路安全事件之後,其政府正在考慮為人工智慧增加額外防護措施。

Trump說,美國必須在保護AI風險與維持對中國的技術優勢之間取得平衡。

Trump表示:「我們正在看AI,也正在看控制措施。」

OPENAI CO-FOUNDER WARNS AI MODELS ARE BECOMING HARDER TO CONTROL AFTER ITS MODEL HACKED ANOTHER FIRM

他補充說:「誰在AI領域獲勝,誰就會贏。它就是這麼重要。它比網際網路曾經更重要,比以往任何事物都更重要。所以我不想限制。我認識這些人中的許多人。我不想限制他們做出偉大工作。」

這項公告發布的一天前,OpenAI執行長Sam Altman在其公司自身發生網路安全事件後,承認公眾對人工智慧的擔憂正在升高。

CLICK HERE TO DOWNLOAD THE FOX NEWS APP

Altman告訴FOX Business:「在任何新的能力層級之後,人們感到害怕,我認為這是非常自然的。」他說:「顯然,我們非常認真看待這件事,之後也會繼續如此。不過我會說,我理解,我明白。很多AI的發展都非常順利,而這是一個人們會說『好,我們到了新的層級』的時刻。」

當被問及OpenAI的模型是否可能也曾入侵其他公司的系統時,Altman回答:「有可能,是的。」