Google Gemini应用月活用户突破10亿,但模型在基准测试中仍落后于竞争对手
要点速览
- •Gemini月活用户已突破10亿,其中iOS活跃用户超过1亿,借助Google生态系统获得了独立应用竞争对手所缺乏的分发优势。
- •Google在里程碑前发布了三款新的Flash层级模型,Gemini 3.6 Flash成为默认生产模型,Flash Cyber是其首款漏洞检测模型,仅限政府和经过审查的合作方使用。
- •独立基准测试将Google最强模型Gemini 3.6 Flash在Artificial Analysis Intelligence Index上的得分定为52分,落后于Anthropic的Claude Opus 5的63分及其他多个竞争对手。
- •语音互动占Gemini使用量的63%,该应用每天生成超过1.5亿张图片,Android集成现已支持在超过40个应用中进行应用内操作。
- •Google DeepMind推出了SL2T手语转文本模型,使用超过10万小时、涵盖50多种手语的数据训练,首先在Pixel 11上支持美国手语转英语。

Google本周宣布其Gemini应用月活用户已突破10亿,尽管独立基准测试将该公司的最强模型排名置于竞争对手Anthropic和OpenAI之后。
Gemini月活用户达到10亿
该消息在Google正在进行的Made by Google发布会上公布。公司将Gemini描述为其历史上增长最快的产品,并表示正在争取下一个10亿用户。
Gemini受益于Google现有产品生态系统的深度整合,包括Android、Workspace和Search,这为其提供了主要通过独立应用运营的竞争对手所不具备的分发渠道。
语音互动已成为用户参与的主要驱动力。根据Google的数据,63%的Gemini用户通过语音与助手交流,其中部分用户完全依赖语音。公司指出,忙碌的父母在日常任务中使用语音的可能性高出43%。图像生成方面也显著增长,该应用每天生成超过1.5亿张图片。
在Apple的iOS平台上,Gemini已超过1亿活跃用户。macOS用户是最活跃的群体之一,提交提示词的频率大约是其他平台用户的两倍。在Android上,Gemini现在可以在超过40个应用中触发应用内操作。
新模型在里程碑前发布
在用户里程碑达成前几天,Google发布了三款专注于成本效率和规模的新模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber。
Gemini 3.6 Flash现为Google的默认生产模型,输出token消耗约减少17%,并支持超过100万个token的上下文窗口。
Flash Cyber是Google首款专为识别和修补软件漏洞而设计的Gemini模型。目前,该技术仅限政府机构和经过审查的合作方在受限项目中使用。
对Flash层级效率的重视正值整个行业的AI提供商面临越来越大的压力,需要在保持输出质量的同时降低推理成本,尤其是在高体量的消费级应用场景中。
基准测试表现落后于竞争对手
在Artificial Analysis Intelligence Index上,Anthropic的Claude Opus 5以63分领先,而Google排名最高的参赛模型Gemini 3.6 Flash得分为52。OpenAI、xAI和Kimi的模型也排在Google顶级模型之上或同等水平。
Artificial Analysis确实将Gemini 2.5 Flash-Lite评为其跟踪的最快模型,首次响应时间仅为0.31秒。然而,该模型在综合评估编码、推理和知识的智能基准测试中表现落后。
Gemini的用户采用率与其基准测试排名之间的差距凸显了行业的一个更广泛趋势:生成式AI的用户触达不仅取决于模型质量排名,还受到分发渠道、产品整合和品牌认知度的影响。
扩展的集成与无障碍功能
Google在发布会上宣布,Gemini将在未来几周内新增与多项服务的连接,包括Wix、OpenTable、Ticketmaster、Pandora、Angi和Zocdoc。
Google DeepMind还推出了SL2T,一种手语转文本模型,使用超过10万小时、涵盖50多种手语的数据进行训练。该模型为Pixel 11上的Gboard和Live Transcribe提供手语转文本听写功能,首先支持美国手语转英语。该功能使听障用户可以在通常需要打字的场景中向手机使用手语,详情见DeepMind博客。