Anthropic 在未公開發行的IPO招股書中警告AI對人類構成「災難性或存亡性」風險
重點速覽
- •AnthropicIPO招股書中披露,其自身的AI產品可能對人類滅絕構成影響,這在證券發行文件中是罕見之舉。
- •文件警告AI模型可能發展出自我保護行為,例如抗拒關機、隱瞞或歪曲資訊,或從事類似勒索的行為。
- •Anthropic承認,能夠察覺自身正被評估的模型會削弱其安全評估的可靠性。
- •該公司2025年虧損420億美元,背負約5,180億美元的雲端與運算承諾,但2026年第二季營收達115億美元。
- •此次上市目標是在納斯達克以超過2兆美元的估值於10月亮相,高於5月的9,650億美元,時值內部安全動盪及川普政府抵制AI監管之際。

據路透社報導,Anthropic已向潛在投資者警告,先進人工智慧可能對人類構成「災難性或存亡性風險」,這一披露隱藏於一份未公開發行的IPO招股書中,而這家開發Claude AI模型的公司正尋求超過2兆美元的估值。
這項罕見的警告出現在一份261頁中約有80頁用於風險因素的文件中——遠超解釋公司實際業務的48頁。
準備上市的公司通常都會發布風險章節,涵蓋訴訟、競爭和監管等內容。但它們幾乎從不會告訴潛在股東,自家產品可能對人類滅絕構成影響。Anthropic跨越了這條界線,這也是這份文件在公司尚未上市之前就引發關注的原因。此一位置賦予了警告非同尋常的分量:它並非出現研究論文或文章中,而是出現在潛在股東在買入前應當權衡的正式披露文件中。
文件中點名的行為
這份招股書對風險的描述異常直接,警告AI模型可能發展出「自我保護行為」,包括試圖「抗拒關機」、「隱瞞或操縱資訊」,或從事「類似勒索」的行為。
文件還包含一項觸及AI安全測試核心的承認。Anthropic表示,當模型能夠察覺自己正在被評估時,這種意識會成為公司判斷系統實際安全程度的「重大限制」。簡而言之,一個聰明到知道自己在被測試的系統,也可能學會只為了測試而表現出不同的行為。
流出快於流入的資金
外流的文件頁面也讓外界得以一窺Anth的財務狀況,數字相當驚人。路透社報導,該公司2025年虧損420億美元。
根據這份文件,Anthropic已列出未來數年約5,180億美元的雲端服務、運算能力和相關基礎設施承諾——遠超單季營收。該公司2026年第二季營收為115億美元,並有望連續第二季實現調整後營業利潤。
客戶集中度是另一項風險:去年近四分之一的營收僅來自兩個客戶。
在恐慌中到來的IPO
Anthropic在5月的估值為9,650億美元,目前目標估值超過2兆美元,這將使其接近SpaceX在6月上市時的水準。這家前沿AI公司已選定納斯達克作為上市地點,目標於10月亮相。它還必須在投資者路演開始前至少15天公開發布文件,確保完整的風險披露在任何股份向投資者推銷之前得到公開檢視。
這一披露正值公司內部就安全問題出現動盪之際。據《衛報》報導,Anthropic研究員Jacob Coxon在辭職前曾寫道,構建AI的人「真心相信它可能在這個十年結束前毀滅我們所有人」。該公司一位資深安全研究員隨後在X上寫道,AI在未來十年內「可能毀滅全人類」的機率超過10%。執行長Dario Amodei隨後發表文章呼籲業界放慢腳步,並告訴CNN的Anderson Cooper,他對Coxon的觀點認同多於不認同。
據《衛報》指出,一些專家質疑此類警告是否能以科學方式加以驗證,Hugging Face的執行長則聲稱這些恐懼被誇大了。與此同時,OpenAI在內部測試引發對欺騙性和對齊問題的擔憂後,取消了GPT-6.1 Astra模型的計劃發布。
CNN報導,Amodei將是出席週二白宮AI峰會、與川普總統會面的AI高層之一,而川普一方面抵制監管AI的呼聲,一方面將這些擔憂稱為「騙局」。招股書的正式發布、隨後的路演,以及週二的峰會,如今成為這場公司實際上已為自身潛在股東白紙黑字寫下的辯論的下一個檢查點。