新聞股票Google Gemini 應用程式月活躍用戶突破 10 億,但模型在基準測試中仍落後競爭對手

Google Gemini 應用程式月活躍用戶突破 10 億,但模型在基準測試中仍落後競爭對手

作者: Cryptopolitan·

重點速覽

  • Gemini 月活躍用戶已突破 10 億,其中 iOS 活躍用戶超過 1 億,透過 Google 生態系統的分發優勢,擁有獨立應用程式競爭對手所缺乏的管道。
  • Google 在里程碑達成前發布了三款新的 Flash 系列模型,Gemini 3.6 Flash 成為預設生產模型,Flash Cyber 則是首款漏洞偵測模型,僅限政府和經審核合作夥伴使用。
  • 獨立基準測試將 Google 最強的模型 Gemini 3.6 Flash 在 Artificial Analysis 智慧指數上評為 52 分,落後 Anthropic 的 Claude Opus 5(63 分)及其他多家競爭對手。
  • 語音互動佔 Gemini 使用量的 63%,應用程式每天生成超過 1.5 億張圖像,Android 整合現已支援超過 40 個應用程式的應用內操作。
  • Google DeepMind 推出 SL2T 手語轉文字模型,使用超過 10 萬小時、涵蓋超過 50 種手語的資料訓練,首先在 Pixel 11 上支援美國手語轉英語。
Google Gemini 應用程式月活躍用戶突破 10 億,但模型在基準測試中仍落後競爭對手

Google 本週宣布其 Gemini 應用程式月活躍用戶已突破 10 億,即使獨立基準測試將該公司最強的模型評為落後於競爭對手 Anthropic 和 OpenAI。

Gemini 月活躍用戶達到 10 億

此消息在 Google 持續進行的 Made by Google 發表會上宣布。該公司將 Gemini 描述為其歷史上增長最快的產品,並表示正積極爭取下一個 10 億用戶。

Gemini 受惠於 Google 現有產品生態系統的深度整合,包括 Android、Workspace 和搜尋,使其擁有主要透過獨立應用程式運營的競爭對手所不具備的分發管道。

語音互動已成為推動參與度的主要驅動力。根據 Google 的數據,63% 的 Gemini 用戶透過語音與助理溝通,其中部分用戶完全依賴語音。該公司指出,忙碌的父母在日常任務中使用語音的可能性高出 43%。圖像生成功能也顯著成長,該應用程式每天生成超過 1.5 億張圖像。

在 Apple 的 iOS 平台上,Gemini 已超越 1 億活躍用戶。macOS 用戶最為活躍,提交提示詞的頻率約為其他平台的兩倍。在 Android 上,Gemini 現可在超過 40 個應用程式中觸發應用內操作。

里程碑前夕推出新模型

在用戶里程碑達成的前幾天,Google 發布了三款專注於成本效益和規模的新模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber。

Gemini 3.6 Flash 現為 Google 的預設生產模型,輸出 token 效率提升約 17%,並支援超過 100 萬 token 的上下文視窗。

Flash Cyber 是 Google 首款專門設計用於識別和修復軟體漏洞的 Gemini 模型。目前,該技術僅在受限計畫下提供給政府和經過審核的合作夥伴使用。

對 Flash 系列效率的重視,正值全行業 AI 供應商面臨越來越大的壓力,需要在維持輸出品質的同時降低推理成本,特別是針對高使用量的消費級應用場景。

基準測試表現落後競爭對手

在 Artificial Analysis 智慧指數上,Anthropic 的 Claude Opus 5 以 63 分領先,而 Google 排名最高的 Gemini 3.6 Flash 僅得 52 分。來自 OpenAI、xAI 和 Kimi 的模型也排名高於或與 Google 的最佳模型持平。

Artificial Analysis 確實將 Gemini 2.5 Flash-Lite 評為其追蹤的最快模型,首次回應時間為 0.31 秒。然而,該模型在綜合評估程式編寫、推理和知識的綜合智慧基準測試中表現落後。

Gemini 用戶採用率與基準測試排名之間的差距,凸顯了行業內更廣泛的趨勢:生成式 AI 的消費者覆蓋範圍不僅取決於模型品質排名,還受到分發管道、產品整合和品牌認知度的影響。

擴展整合與無障礙功能

Google 在發表會上宣布,Gemini 將在未來幾週內連接更多服務,包括 Wix、OpenTable、Ticketmaster、Pandora、Angi 和 Zocdoc。

Google DeepMind 還推出了 SL2T,一款手語轉文字模型,使用超過 10 萬小時、涵蓋超過 50 種手語的資料進行訓練。該模型為 Pixel 11 上的 Gboard 和 Live Transcribe 提供手語轉文字聽寫功能,首先支援美國手語轉英語。該功能讓聾啞用戶可以在通常需要打字的情境下用手語與手機溝通,詳情請見 DeepMind 部落格。