Google 推出 Gemini 4 Argon 進階程式編寫模型,因網路安全風險限制存取權限
重點速覽
- •Gemini 4 Argon 於 9 月 30 日透過 Google 的 Fairwind 計畫發布,初期存取權限僅限獲選的政府、受信任的合作夥伴及 Google 自身團隊,更廣泛的推出日期尚未確定。
- •Google 表示 Argon 在 DeepSWE v1.1 軟體工程基準測試中取得 77.9% 的成績,領先得分 74.2% 的 Claude Opus 5.5 與得分 74.1% 的 GPT-6 Astra,惟這些數據來自 Google 自身的評估。
- •該模型可在單一回應中生成最多 100 萬個代幣,較先前模型 64,000 個代幣的輸出上限大幅提升。
- •在 Google 內部,數千名員工使用 Argon進行將 C 與 C++ 程式碼庫遷移至 Rust 等工作,包括 Fuchsia 作業系統 Zircon 核心中超過 80 萬行的程式碼庫。
- •Argon 以每百萬輸入代幣 2 美元、每百萬輸出代幣 10 美元的導入價推出,導入期後分別上調至 4 美元與 20 美元,快取輸入代幣享有 95% 折扣。

Google 已推出 Gemini 4 Argon,即 Gemini 4 世代的首款模型,初期存取權限僅限受信任的網路安全防禦者與 Google 內部團隊。
該公司於 9 月 30 日透過其 Fairwind 計畫宣布推出 Argon,該計畫讓獲選的政府與受信任的合作夥伴能夠存取 Google 的進階網路安全模型。根據官方公告,Argon 可自主發現、驗證並修補關鍵軟體漏洞。Google 目前暫緩更廣泛的存取權限,同時持續測試該模型並完善其安全防護措施。
付費應用程式介面(API)客戶與 Google AI Ultra 訂閱者之後將可獲得存取權限,但 Google 尚未宣布更大範圍推出的具體日期。
Google 稱 Argon 的比較表現
Google 表示,Argon 在軟體工程任務基準測試 DeepSWE v1.1 上獲得 77.9% 的成績。在同一測試中,該公司指出 Anthropic 的 Claude Opus 5.5 為 74.2%,OpenAI 的 GPT-6 Astra 為 74.1%。
在評估 AI 模型辨識與修復軟體漏洞能力的 CWE-bench v1 上,Google 表示 Argon 得分為 68%,與 GPT-6 Astra 持平。這些基準測試數據來自 Google 自身的評估,因此無法獨立證明 Argon 在實際工作負載中的表現。
Argon 還能在單一回應中生成最多 100 萬個代幣,相較之下,先前模型的輸出上限為 64,000 個代幣。代幣是 AI 模型處理與生成文字的基本單位。更大的輸出上限旨在讓 Argon 能夠處理更長的軟體工程及其他複雜任務,而無需反覆提示其繼續。
內部部署
Google 表示,Argon 已在內部被數千名員工用於程式編寫、研究及其他專門任務。其中一項已知的用途是將 C 與 C++ 程式碼庫遷移至 Rust,這是一種系統程式語言,旨在防止記憶體安全錯誤——這些錯誤是軟體漏洞眾所周知的來源。據 Google 稱,Argon 代理正在處理其 Fuchsia 作業系統 Zircon 核心中從數萬行到超過 80 萬行不等的程式碼庫。
該公司表示,較大規模的程式碼遷移在部署至正式環境前,均須經過自動化與人工稽核、模擬測試與審查。核心程式碼位於作業系統的核心位置,其中的錯誤可能影響其上運行的每個元件。
Google 也使用 Argon 代理分析資料中心效能數據並找出記憶體優化方案。該公司表示,這些變更在全面推出後預計可釋放超過 300 tebibytes 的記憶體,總節省量估計介於 500 tebibytes 至 1 pebibyte 之間。1 pebibyte 相當於 1,024 tebibytes。
Google 的量子運算研究人員也使用 Argon 優化演算法。該公司舉例表示,Argon 在幾分鐘內便在一項量子運算任務上超越已公開的基準達 40%。
為何分階段開放存取
Argon 的網路安全能力是分階段推出的主要原因。Google 表示,該模型能在極少人工介入的情況下辨識並修復漏洞,隨著此類能力變得更加普及,這既帶來防禦價值,也帶來潛在的安全風險。因此,該公司透過 Fairwind 先讓受信任的網路防禦者使用該模型,同時蒐集回饋並持續開發安全防護措施。
Google 表示,隨著存取權限擴大,Argon 最終將向開發者、企業與消費者開放。
定價
Google 將以每百萬輸入代幣 2 美元、每百萬輸出代幣 10 美元的導入價推出 Argon。導入期過後,價格將上調至每百萬輸入代幣 4 美元、每百萬輸出代幣 20 美元。快取輸入代幣可在不同請求間重複使用相同的上下文,其輸入代幣價格將享有 95% 折扣。
此次推出正值 Google 與 OpenAI 及 Anthropic 在程式編寫、網路安全、研究與企業應用等領域競相開發功能日益強大的 AI 模型之際。不過,目前 Google 自身的基準測試仍是 Argon 主要的公開效能指標;更廣泛的開放將讓獨立使用者與研究人員能在更多工作負載中測試該模型。