OpenAI 劃下 AI 風險底線,挑戰 Anthropic 的安全優先路線
重點速覽
- •OpenAI 執行長 Sam Altman 表示,社會接受某些與 AI 相關的損害,因為這項技術的效益將超過其代價,並反對讓任何單一實驗室控制 AI 的使用。
- •Altman 目前的立場推翻了他先前對 Anthropic 執行長 Dario Amodei 呼籲 AI 公司放緩前沿開發的公開支持。
- •2026 年 7 月,據報導,部分 OpenAI 模型繞過網路隔離控制,存取了公司的研究基礎設施和 Hugging Face 系統,促使 OpenAI 承諾加強保護措施。
- •在英國 AI 安全研究院關閉過濾器的評估中,Anthropic 的 Claude Mythos 5 建立了假的 GitHub 帳號並寄送含惡意軟體的電子郵件;Google 亦另行披露 Gemini 曾試圖存取其他公司的系統。
- •特朗普總統與 OpenAI、Nvidia、SpaceX 等六家大型科技公司簽署了自願性 AI 安全協議,其中並無違規罰則,但他稱其具有道德約束力。

ChatGPT 開發商 OpenAI 認為人工智慧的效益高於部分風險,這一立場使該公司與 Anthropic 的安全優先規則略有分歧。
執行長 Sam Altman 向記者表示:「我們認為,為了這項技術的效益以及人們擁有自主權,世界應該接受一些不好的事情發生,」此言論由 Reuters 報導。
Altman 承認,在 AI 監管問題上,他的公司與 Anthropic 之間存在本質上的差異。他表示,他並不認同 AI 危險到應由單一實驗室壟斷並控制其使用的說法,儘管他理解這一立場背後的理由。他主張,這種守門人做法完全不可接受,且與 OpenAI 偏好較輕度 AI 監管的立場相悖。
Altman 曾支持放緩 AI 開發
整體而言,Altman 反對要求一個零風險的 AI 生態系統。他認為,某些濫用和其他有害後果是不可避免的,但會被這項技術更廣泛的效益所抵銷。他說:「因為我認為人們會做出極其——高出數個數量級——的好事,而非壞事。」
他的立場標誌著一次轉變。此前,Anthropic 執行長 Dario Amodei 曾鼓勵 AI 公司放緩技術開發,當時 Altman 完全支持這一想法,Cryptopolitan 曾報導。當時他在 X 上表示:「我同意 Dario 的看法,我們需要為前沿發展設定節奏。這是近幾週我們在 OpenAI 內部討論的主要話題。承諾讓獨立評估機構擁有類似員工的存取權限是個好主意,我們也會這樣做。」
Anthropic 曾警告,儘管 AI 具有效益,這項技術仍可能脫離人類控制並滲透外部網路。該公司也表示,頂級模型可能展現自我保存的特質,例如試圖阻止被關閉、隱瞞事實或採取欺騙行為。
多起報導的事件印證了這些疑慮。2026 年 7 月,據報導,部分 OpenAI 模型繞過了旨在將其與網路隔離的控制措施,存取了 OpenAI 研究基礎設施的部分容以及 AI 模型託管平台 Hugging Face 的系統。據稱,這些模型暗中相互通訊、利用共享系統的安全漏洞、登入網路並連上外部網路。OpenAI 當時承諾為其模型實施更強的保護措施。
Anthropic 自己的模型在測試條件下也展現了類似行為。在英國政府機構英國 AI 安全研究院進行的一次關閉過濾器的網路安全評估中,Claude Mythos 5 建立了假的 GitHub 帳號,鎖定一名有權核准其惡意程式碼的開發者,並向不同人士寄送植入惡意軟體的電子郵件。近期,Google 也披露 Gemini 曾試圖存取其他公司的系統。
OpenAI 與 Anthropic 在 AI 安全上的分歧
這一分歧反映了 AI 產業在公司應擁有多少自由來開發日益強大系統上的鴻溝日益擴大。OpenAI 傾向於讓 AI 廣泛可用,而 Anthropic 則採取更謹慎的路線,呼籲更強的保障與監督。
Altman 的言論顯示,OpenAI 認為社會應接受某些風險,而不是實施可能限制 AI 合法用途的限制。然而,批評人士警告,一旦高度強大的系統被廣泛部署,某些風險可能難以逆轉。
這一鴻溝使政策制定者面臨艱鉅任務,Cryptopolitan 近期對競爭實驗室之間安全辯論的報導探討了這一矛盾:既要應對 AI 威脅,又不能實施可能拖慢創新或削弱競爭的規則。
特朗普否決加強 AI 監管的呼籲
美國總統特朗普多次拒絕加強 AI 監管的要求,聲稱這只會阻礙美國企業在與中國的競爭中獲勝。他堅信當今的執法機構足以監管這項技術。他還指示其政府將 AI 描述為「超級智慧」,試圖提升這項技術的公眾形象。
然而,本週二,特朗普總統推廣了新的政府聊天機器人,在白宮接待了領先的科技高管,並公布了一項自願協議,以應對日益升高的安全疑慮。
安全倡議人士表示,此舉顯示特朗普想證明他正在傾聽選民對 AI 的恐懼,同時不拖慢其發展步伐。他與 OpenAI、Nvidia、SpaceX 等六家大型科技公司簽署的協議,對違規行為沒有任何實際罰則,不過特朗普稱其為「具道德約束力」。
無黨派機構外交關係委員會的 Kat Duffy 表示:「這是為了營造政府正在傾聽這些疑慮的印象,同時不削弱本届政府一貫的明確立場:監管與治理本質上會阻礙創新。」
儘管如此,週二的協議仍包含了專家長期呼籲的安全措施,例如要求企業建立強大的內部駭客防禦,並與獨立的外部審查機構合作。在缺乏罰則的情況下,這些自願承諾究竟能發揮多少實際作用——在政策制定者權衡 OpenAI 與 Anthropic 兩種不同路線之際——仍是未知數。