新聞股票Google DeepMind 發布 Gemini 3.7 Flash,迄今最強大的程式開發與智慧代理模型

Google DeepMind 發布 Gemini 3.7 Flash,迄今最強大的程式開發與智慧代理模型

作者: Google DeepMind Blog·

重點速覽

  • Gemini 3.7 Flash 於 2026 年 8 月 13 日發布,距前代 Gemini 3.6 Flash 僅三週,反映出加速的發布節奏。
  • 該模型在解決真實 GitHub 問題的 DeepSWE v1.1 基準測試中得分 65.3%,高於 3.6 Flash 的 49.0%,並在 FrontierCode 1.1 Main 程式開發基準測試中從 34.4% 提升至 43.6%。
  • 優惠定價為每百萬輸入 token 0.75 美元及每百萬輸出 token 3.75 美元,有效期至 2026 年 12 月 31 日,之後費率將調漲一倍。
  • 可供超過 160 個國家 Google AI Pro 及 Ultra 訂閱者使用的個人 AI 代理 Gemini Spark,於發布當日即開始使用 Gemini 3.7 Flash 以增強 Google Workspace 工作流程。
  • 該模型搭載更新的 Frontier Safety 安全防護機制,針對化學、生物、放射、核武及網路攻擊領域的濫用行為。
Google DeepMind 發布 Gemini 3.7 Flash,迄今最強大的程式開發與智慧代理模型

Google DeepMind 發布 Gemini 3.7 Flash,迄今最強大的程式開發與智慧代理模型

Google DeepMind 宣布推出 Gemini 3.7 Flash,該公司將其描述為迄今為止最適合程式開發與智慧代理驅動工作流程的強大模型。此公告於 2026 年 8 月 13 日由產品管理資深總監 Tulsee Doshi 代表 Gemini 團隊發布。

此次發布距離 Gemini 3.6 Flash 的發布僅三週,延續了 DeepMind 近乎每月更新 Flash 級模型的節奏。如此緊湊的發布間隔反映了產業的一項趨勢:前沿模型供應商正以更快的週期推出漸進但可量化的改進,這些改進通常源於開發者回饋,而非長達數月的研究里程碑。據 Google DeepMind 表示,3.7 Flash 是開發者回饋與演算法創新的直接成果,公司計畫將這些創新延續至未來的模型中。此次新版本在軟體工程、知識型工作及網頁開發工作流程方面帶來了大幅改善,優惠價格設定為 3.6 Flash 原始每百萬 token 成本的一半。

程式開發、網頁開發與知識型工作的效能提升

Gemini 3.7 Flash 在除錯與問題解決等程式開發任務中展現出相比前代模型的顯著進步。該模型實現了更高的首次程式碼準確率,並在生成可用於正式環境的程式碼方面表現更佳,根據 FrontierCode 1.1 Main 基準測試,其得分為 43.6%,而 3.6 Flash 為 34.4%。在 DeepSWE v1.1 ——一項評估模型端到端解決真實 GitHub 問題能力的測試中——3.7 Flash 得分 65.3%,而 3.6 Flash 為 49.0%。

在網頁開發方面,3.7 Flash 能以更少的提示次數生成功能更完善的版面配置和功能完整的應用程式。在 UI 生成方面,該模型對截圖、圖片及完整設計系統等參考輸入展現出高度的設計遵循度與一致性。在 Arena.ai 的 WebDev Arena 上,3.7 Flash 達到了 1588 的 Elo 分數,而 3.6 Flash 為 1538。

在金融、法律及生物科學等知識密集領域,3.7 Flash 提供了更佳的推理能力與準確度。它在 GDP.pdf 基準測試——一項評估模型處理複雜文件能力的測試——上顯著超越 3.6 Flash,得分為 34.0%,而 3.6 Flash 為 22.0%。該模型在 AutomationBench 上也超越了 3.6 Flash,該測試衡量完成真實商業工作流程的能力,3.7 Flash 得分 30.4%,而 3.6 Flash 為 17.0%。

Google DeepMind 強調了 3.7 Flash 所支援的多項應用場景,包括結合 Nano Banana 從文字提示生成完整可玩的 3D 遊戲、透過 Gemini Omni 協調子代理一次性創建互動式登入頁面、在三代理圖循環中使用多模態理解來訓練機器人模型,以及將靜態 PDF(如年報)轉換為包含即時圖表與彙整洞察的互動式網頁體驗。

開發者體驗與定價

據 Google DeepMind 表示,Gemini 3.7 Flash 提供了相比 3.6 Flash 明顯改善的開發者體驗。該模型能更好地應對障礙、在必要時釐清意圖,並以更高的精準度遵循指令。它也展現出更為周密的多步驟規劃與工具呼叫執行能力,從而在工程工作流程中減少人工監督和重試次數。

3.7 Flash 於 2026 年底前提供優惠價格,每 100 萬輸入 token 為 0.75 美元,每 100 萬輸出 token 為 3.75 美元。Google DeepMind 表示,此一定價結合模型增強的效能,使開發者和客戶能夠以符合成本效益的方式擴展可用於正式環境的智慧代理。早期客戶回饋據報導凸顯了 3.7 Flash 的效能與精準度,以低成本取得了顯著優於 3.6 Flash 的成果。

優惠定價將於 2026 年 12 月 31 日到期。自 2027 年 1 月 1 日起,費率將調整為每 100 萬輸入 token 1.50 美元及每 100 萬輸出 token 7.50 美元。

Gemini Spark 整合

Gemini Spark 於 2026 年 8 月 13 日起開始使用 Gemini 3.7 Flash,可供超過 160 個國家的 Google AI Pro 及 Ultra 訂閱者使用。Spark 最初於 Google I/O 上推出,被描述為一個全天候運作的個人 AI 代理,在使用者的指示下代為執行各項操作。此次模型更新旨在提升 Spark 在知識型工作中的效率,改善對 Google Workspace 應用程式的工具使用,為複雜的多技能工作流程提供更高的準確度與輸出品質。透過 3.7 Flash,Spark 能更有效率地彙整檔案、起草電子郵件及更新狀態文件。

安全措施

Google DeepMind 表示,公司持續致力於提升其 Frontier Safety 安全防護的涵蓋範圍與穩健性。Gemini 3.7 Flash 搭載了更新的安全防護機制,以應對化學、生物、放射及核武(CBRN)威脅與網路攻擊領域的濫用行為,同時在符合公司 生物韌性 方針及 網路安全計畫 的前提下,支援有益的使用案例。更多詳情請參閱 3.7 Flash 模型卡

可用性

  • 開發者: 在 Google Antigravity 中探索智慧代理優先的工作流程,或透過 Google AI Studio 和 Android Studio 使用 Gemini API 開始建構。開發者指南 已可供使用。
  • 企業: 透過 Gemini Enterprise Agent Platform 和 Gemini Enterprise 應用程式 使用 3.7 Flash。
  • 個人用戶: 可透過支援國家 Google AI Pro 及 Ultra 訂閱者的 Gemini 應用程式中的 Spark 使用。

來源:Google DeepMind 部落格