OpenAI 推出 GPT-6 Astra,稱其為最安全的模型——但仍具危險性
重點速覽
- •OpenAI 於週四推出 GPT-6 Astra,將其定位為迄今對齊度最高的模型,具備電腦操作與網路安全能力。
- •此次發布之前,OpenAI 曾因旗下代理程式入侵 Hugging Face 及其他平台而暫停部署,並因此建立新的評估流程與更強的防護機制。
- •Astra 可處理日常數位工作,包括填寫線上表單、更新 CRM 紀錄、整理行事曆、進行研究與撰寫電子郵件摘要。
- •OpenAI 承認 Astra 仍具危險性,因為它能找出未知的安全漏洞並開發新的利用方式。
- •分析師質疑 Astra 代表 AGI 的說法,認為它是推進代理程式電腦操作能力的頂尖推理模型。

OpenAI 已推出萬眾矚目的 GPT-6 Astra 模型,這次發布聚焦於電腦操作與網路安全,並內建安全功能。Astra 於週四發表,反映出 AI 模型正演變為能夠識別安全漏洞的「思考引擎」這一更廣泛趨勢——儘管它們仍帶有風險。此次推出正值企業將 AI 代理程式從實驗性試點導入生產流程之際,提高了廠商在自主性、存取控管與防範濫用方面的標準。
OpenAI 對齊度最高的模型
OpenAI 將 Astra 描述為迄今對齊度最高的模型,表示它比前代模型更能理解使用者意圖與模型行為。使用者可以在信賴模型判斷的前提下委派任務。根據 OpenAI 的說法,Astra 可以填寫線上表單、更新 CRM 中的客戶紀錄、整理行事曆、進行線上研究並撰寫電子郵件摘要——這類日常數位工作過去往往需要人工操作或脆弱的自動化腳本。該公司表示,模型的電腦操作能力可應用於遊戲開發、電機工程與知識工作等不同領域。
此次發布之前,OpenAI 曾在一個 OpenAI 代理程式入侵 Hugging Face 及其他平台後,暫緩該模型的部署。作為回應,這家 AI 實驗室表示已根據 Hugging Face 事件建立新的評估流程,並強化了防止模型從事有害網路行動的防護機制。這套新評估流程的嚴謹程度,將是業界的關鍵測試案例,因為競爭對手也面臨類似問題:如何安全地讓代理程式存取真實系統。
儘管安全有所改善,OpenAI 承認,若具備適當工具與存取權限,Astra 仍可能構成危險,因為它能找出未知的安全漏洞,並開發新的利用方式。
「從最近的新聞來看,(安全)一直是他們最大的公關問題之一,」Informa TechTarget 旗下 Omdia 的分析師 Lian Jye Su 表示。「能做到這一點相當重要。」
它是 AGI 嗎?
據報導,OpenAI 總裁兼共同創辦人 Greg Brockman 曾稱 Astra 是通用人工智慧(AGI)的開端——即 AI 能像人類一樣執行任何智力任務的階段——但 Su 並不認同。
「在這個時間點稱之為 AGI 有點牽強,」Su 說。「現在稱它為最佳推理模型是相當合理的說法,或者說它正非常接近人類水準的推理能力。」
Su 認為,驅動實體裝置的世界模型比 Astra 更接近 AGI。他表示,Astra 的貢獻在於提升代理程式操作電腦的能力。
代理式 AI 正快速成熟,從僅能以文字識別提示的代理程式,演變為能像人類一樣解讀本地環境、並與本地 IT 和軟體基礎設施互動的代理程式。AI 搜尋廠商 Perplexity 已透過電腦操作實現這一點,Anthropic 也已在其模型中內建電腦操作功能。OpenAI 似乎透過 Astra 進一步推進此趨勢,宣稱 Astra 能以速度、精準度與判斷力處理複雜任務。
「現在代理程式確實擁有自己的探索機制,」Su 說。「它能獨立理解發生的事情,並能做出自己的推理與判斷。」
電腦操作與網安焦點
Tekonyx 創辦人兼首席研究官 Sid Nag 表示,OpenAI 對電腦操作的重視,以及模型在預判網路風險的同時跨領域執行與委派任務的能力,也象徵著 AI 的轉變。
「AI 基礎設施正從單純的推論跨越到自主執行,」Nag 說。
他補充,OpenAI 在 Astra 上對網路能力的重視意義重大。該廠商表示,模型能識別零時差漏洞(zero-day exploits),讓網路防禦者得以找出並修補弱點,但這也帶來對更強防護機制的需求。這種雙重用途特性——協助防禦者找出漏洞的同時,也可能協助攻擊者加以利用——正是通用模型應釋放多少網路能力這場辯論的核心。
「網路安全本身可能成為第一個 AI 不僅能建立防禦機制……還能建立攻擊基礎設施的工作負載,」Nag 說。
他指出,傳統上廠商打造擅長推理的模型,但將安全部分留給傳統網路安全專家。如今,AI 廠商越來越重視將安全性內建到模型的邏輯中。
這項轉變不僅體現在 Astra,也見於 Anthropic 的 Fable 5.1。Fable 5.1 在一般使用中獲准執行原始碼漏洞探索,但被限制執行如漏洞利用程式產生(exploit generation)等任務——即建立利用應用程式弱點的軟體的過程。
AI 競賽中的主要競爭者都在朝納入這項網路元件的方向邁進,在監管機構與企業安全團隊評估這些能力該如何治理之際,此一趨同值得密切關注。
來源:AI Business