Google 推出 Gemini 3.7 Flash,OpenAI 預覽快 14 倍的 GPT-5.6 Sol Ultrafast
重點速覽
- •Gemini 3.7 Flash 已正式全面提供,並可在超過 160 個國家/地區使用。
- •這個模型最多可接受 100 萬個輸入 tokens,並可處理文字、圖片、影片、音訊、PDF 與工具呼叫。
- •Google 表示,Gemini 3.7 Flash 的測試編碼任務耗時 2 分 13 秒,比前一代 Flash 模型更快。
- •OpenAI 預覽了採邀請制的 GPT-5.6 Sol Ultrafast API 層級,使用 Cerebras 晶片,輸出速度最高可達每秒 750 個 tokens。
- •Google 將 Gemini 3.7 Flash 定價為每 100 萬個輸入 tokens 75 美分、每 100 萬個輸出 tokens $3.75,至年底前有效,12 月 31 日後將調升。

Google 於週四推出 Gemini 3.7 Flash,這是一款低成本、面向程式編碼與 agents 的模型,目前已正式全面提供。同一天,OpenAI 預覽了 GPT-5.6 Sol Ultrafast,這是一個由 Cerebras 支援的服務層級,可讓其最強模型的速度最高提升 14 倍。速度競賽的重心已從原始智慧轉向即時 agents,但今天只有 Google 的模型能讓所有開發者使用。
Google 與 OpenAI 今天都傳達了同一訊息:對使用 AI agents 的人來說,AI 已經快到足以帶來明顯印象的程度,兩家公司都宣布了超高速模型。兩項發佈的架構不同,而且今天真正已到開發者手中的只有一個。對速度的重視是結構性的:agents 可以連續串接多次模型呼叫——規劃、呼叫工具、檢查結果——因此單次呼叫的延遲會在整個任務中累積。
Google 推出 Gemini 3.7 Flash,這是其最新、針對軟體編碼與自主商務工作流程調校的模型。OpenAI 則開放 GPT-5.6 Sol Ultrafast 的有限預覽,這是新的服務層級,可讓其最強模型的輸出速度最高達每秒 750 個 tokens。
今天我們推出 Gemini 3.7 Flash,這是我們迄今在編碼與 agents 方面最智慧的主力模型。這個模型在軟體工程、網頁開發與複雜知識工作上都有顯著提升。從現在到今年底,Gemini 3.7 Flash 將可使用… pic.twitter.com/RSCBDipjKn
— Google (@Google) August 13, 2026 (X 貼文)
Gemini 3.7 Flash 是一個正式全面提供的模型。它可接受最多 100 萬個輸入 tokens——約 750,000 個字——並回傳 64,000 個 tokens,可處理文字、圖片、影片、音訊與 PDFs,也能呼叫工具並控制電腦。Google 將其定位為能以較少人工介入來規劃任務並完成多步驟工作的自主系統之低成本核心。
這個模型並未為了速度犧牲品質。它同時更強也更有效率,在 Google 的測試編碼任務中只用了 2 分 13 秒完成,而最新的 Flash 模型則花了超過 5 分鐘。兩者之間的品質差距也很明顯。
OpenAI 的 Ultrafast 並不是新模型。它是 GPT-5.6 Sol——也就是 OpenAI 在發布前曾用 AI 紅隊測試、以強化其抵禦提示注入攻擊的同一模型——只是走在更快的路徑上,由晶片製造商 Cerebras 提供加速。其速度大約是 GPT-5.6 Sol 標準速度的 14 倍。
預覽 Ultrafast 模式:GPT-5.6 Sol 的速度最高可達 14 倍。將先在 OpenAI API 中向一小部分客戶推出,並隨著容量提升,逐步開放給更多企業。 pic.twitter.com/a5dleofiDJ
— OpenAI (@OpenAI) August 13, 2026 (X 貼文)
Cerebras 的 wafer-scale 晶片每秒可產生高達 750 個 tokens,約 560 個字,快到足以讓語音 agent 在通話中途即時思考。
重要數據
Google 自家的基準測試表顯示,Gemini 3.7 Flash 在 18 個測試類別中的 11 項領先 Claude Sonnet 5、GPT-5.6 Terra 與其他模型,包括 Code Arena 網頁開發 1,588 Elo 的最高分,以及企業工作流程 AutomationBench 的 30.4%。以上都基於 Google 的方法論,因此應將這項領先視為該公司的主張。
和任何 Gemini Flash 模型一樣,這款模型也很便宜。在今年底前,每 100 萬個輸入 tokens 收費 75 美分、每 100 萬個輸出 tokens 收費 $3.75,只有 Gemini 3.6 Flash 原始價格的一半。這個優惠價將於 12 月 31 日到期,之後漲為 $1.50 與 $7.50;對 Google 模型而言,這仍然算便宜。
OpenAI 目前除了客戶引述外,尚未公布 Ultrafast 的正面對照分數。Jane Street AI 工程師 John Crepezzi 在 OpenAI 的公告中表示,Cerebras 的速度「使使用這些模型的方式變得不同」。Podium 產品主管 Courtland Lykins 則稱其「對我們的語音堆疊來說非常有價值」,並表示這種速度「徹底改變了通話體驗」。目前這個層級仍採邀請制。
這波對速度的追求,發生在實驗室從「誰最聰明」轉向「誰對 agents 來說夠快」的時刻。Google 的時機安排相當明確。其旗艦 Gemini 3.5 Pro 仍未推出,且沒有給出發佈日期;這發生在 3.6 Flash 推出三週後,以及 DeepMind 領導層調整數天後,該調整將 Demis Hassabis 退居其次,由副手 Koray Kavukcuoglu 接手。與此同時,OpenAI 則是在租用 Cerebras 的速度,而不是等待自己的技術堆疊成熟。
Gemini 3.7 Flash 現已在超過 160 個國家/地區上線;GPT-5.6 Sol Ultrafast 目前仍為邀請制。