新闻股票Google DeepMind 推出 Gemini 3.7 Flash——面向编程和智能体的最强主力模型

Google DeepMind 推出 Gemini 3.7 Flash——面向编程和智能体的最强主力模型

作者: Google DeepMind Blog·

要点速览

  • Gemini 3.7 Flash 于2026年8月13日发布,距前代产品 Gemini 3.6 Flash 仅三周,反映出加速的发布节奏。
  • 该模型在 DeepSWE v1.1 基准测试中得分65.3%,用于解决真实 GitHub 问题,较 3.6 Flash 的49.0%大幅提升;在 FrontierCode 1.1 Main 编程基准测试中从34.4%提升至43.6%。
  • 入门价格设定为0.75美元/百万输入 token 和3.75美元/百万输出 token,有效期至2026年12月31日,之后价格将翻倍。
  • Gemini Spark 是面向160多个国家 Google AI Pro 和 Ultra 订阅用户的个人 AI 智能体,于发布当天开始使用 Gemini 3.7 Flash 以增强 Google Workspace 工作流程。
  • 该模型附带更新的 Frontier Safety 防护措施,针对化学、生物、放射性、核和网络攻击领域的滥用。
Google DeepMind 推出 Gemini 3.7 Flash——面向编程和智能体的最强主力模型

Google DeepMind 推出 Gemini 3.7 Flash——面向编程和智能体的最强主力模型

Google DeepMind 宣布发布 Gemini 3.7 Flash,该公司将其描述为迄今为止面向编程和智能体驱动工作流程的最智能主力模型。该公告由产品管理高级总监 Tulsee Doshi 代表 Gemini 团队于2026年8月13日发布。

此次发布距 Gemini 3.6 Flash 的发布仅三周,延续了 DeepMind 接近月度 Flash 级别更新的节奏。发布间隔的压缩反映了一种行业趋势:前沿模型提供商正以更快的周期交付增量但可衡量的改进,这些改进通常由开发者反馈驱动,而非依赖于数月的研究里程碑。据 Google DeepMind 表示,3.7 Flash 是开发者反馈和算法创新的直接成果,公司计划将这些创新延续到未来模型中。新版本在软件工程、知识工作和 Web 开发工作流程方面带来了显著改进,入门价格设定为原 3.6 Flash 每百万 token 成本的一半。

编程、Web 开发和知识工作方面的性能提升

Gemini 3.7 Flash 在调试和问题解决等编程任务中较前代产品展现出显著提升。该模型实现了更高的首次代码准确率和生成生产级代码的改进性能,根据 FrontierCode 1.1 Main 基准测试,其得分为43.6%,而 3.6 Flash 为34.4%。在 DeepSWE v1.1 ——一项测试模型端到端解决真实 GitHub 问题能力的评估中——3.7 Flash 得分为65.3%,而 3.6 Flash 为49.0%。

在 Web 开发方面,3.7 Flash 能以更少的提示生成功能更完善的布局和功能完整的应用程序。在 UI 生成方面,该模型相对于参考输入(包括截图、图像和完整设计系统)展现出高度的设计一致性和匹配度。在 Arena.ai 的 WebDev Arena 上,3.7 Flash 的 Elo 得分为1588,而 3.6 Flash 为1538。

对于金融、法律和生物科学等知识密集型领域,3.7 Flash 提供了改进的推理能力和准确性。它在 GDP.pdf 基准测试上显著优于 3.6 Flash——这是一项旨在测试模型处理复杂文档能力的评估——得分为34.0%,而 3.6 Flash 为22.0%。该模型在 AutomationBench 上也超越了 3.6 Flash,该基准衡量完成真实世界业务工作流程的能力,得分为30.4%,相比之下 3.6 Flash 为17.0%。

Google DeepMind 重点介绍了 3.7 Flash 支持的若干用例,包括与 Nano Banana 结合后从文本提示生成完全可玩的3D游戏、通过编排子智能体与 Gemini Omni 协作一步生成交互式落地页、在三个智能体图循环中使用多模态理解训练机器人模型,以及将静态 PDF(如年度报告)转化为带有实时图表和聚合洞察的交互式 Web 体验。

开发者体验与定价

据该公司表示,Gemini 3.7 Flash 提供了比 3.6 Flash 明显改善的开发者体验。该模型能更好地适应障碍,在需要时澄清意图,并以更高的保真度遵循指令。它还展示了更加勤奋的多步骤规划和工具调用执行,从而在工程工作流程中减少了人工监督和重试次数。

3.7 Flash 在2026年底前以0.75美元/百万输入 token 和3.75美元/百万输出 token 的入门价格提供。Google DeepMind 表示,该定价结合模型增强的性能,使开发者和客户能够以高性价比扩展生产级智能体。据报道,早期客户反馈已突出 3.7 Flash 的性能和精确度,以低成本实现了显著优于 3.6 Flash 的结果。

入门价格将于2026年12月31日到期。自2027年1月1日起,价格为1.50美元/百万输入 token 和7.50美元/百万输出 token。

Gemini Spark 集成

Gemini Spark 面向160多个国家的 Google AI Pro 和 Ultra 订阅用户提供,已于2026年8月13日开始使用 Gemini 3.7 Flash。Spark 最初在 Google I/O 上发布,被描述为全天候运行的个人 AI 智能体,在用户的指导下代为执行操作。此次模型更新旨在使 Spark 在知识工作方面更加高效,改进了对 Google Workspace 应用的工具使用,为复杂的多技能工作流程提供更高的准确性和输出质量。借助 3.7 Flash,Spark 可以更高效地整合文件、起草电子邮件和更新状态文档。

安全措施

Google DeepMind 表示,公司持续致力于提升其 Frontier Safety 防护措施的覆盖范围和稳健性。Gemini 3.7 Flash 附带针对化学、生物、放射性和核(CBRN)威胁领域及网络攻击的滥用防护更新,同时支持有益用例,符合公司的生物韧性策略及其网络安全计划。更多详情请参阅 3.7 Flash 模型卡片

可用性

  • **开发者:**在 Google Antigravity 中探索智能体优先的工作流程,或通过 Google AI Studio 和 Android Studio 中的 Gemini API 开始构建。可查阅开发者指南。
  • **企业:**通过 Gemini Enterprise Agent Platform 和 Gemini Enterprise 应用访问 3.7 Flash。
  • **个人用户:**可通过 Gemini 应用中的 Spark 使用,面向支持国家的 Google AI Pro 和 Ultra 订阅用户。

来源:Google DeepMind 博客