Alphabet 旗下 Gemini 4 完成预训练,但后训练工作仍在后头
要点速览
- •Google 于 2026 年 7 月 21 日启动 Gemini 4 预训练,为其史上规模最大的一次,截至 9 月初已报告强劲的初步成果。
- •CEO Sundar Pichai 表示,Gemini 4 将优先发展编程和自主智能体能力,并依赖规模大得多的基础模型。
- •尚未开始的后训练是塑造指令遵循、工具使用和安全部署能力的阶段,发布时间表往往在此阶段出现延误。
- •Alphabet 2026 年高达 2050 亿美元的资本支出指引使该公司首次陷入自由现金流为负的境地。
- •分析师认为最有可能在 2026 年底发布,但 Google 尚未披露正式时间表或公开基准测试。

Google 于 2026 年 7 月 21 日宣布启动 Gemini 4 的预训练,称其为公司历史上规模最大的预训练项目。截至 9 月初,该模型在此阶段已产出强劲的初步成果。然而,后训练尚未开始——而这正是 AI 模型从令人印象深刻的原始计算成果转变为人们实际可用产品的关键阶段。后训练——包括微调、基于人类反馈的强化学习以及指令调优——被普遍认为是决定模型能否可靠地遵循指令、使用工具并在部署中安全运行的关键环节。发布时间表往往正是在这一阶段出现延误,因此其进展与预训练成果同样重要。
Gemini 4 的构建目标
CEO Sundar Pichai 在 7 月 23 日 Alphabet 第二季度财报电话会议上阐述了这一雄心,将 Gemini 4 定位于两个具体优先方向:编程和自主智能体。Pichai 还表示,Gemini 4 将依靠他所称的“规模大得多的基础模型”来应对未来的需求。这两个方向与企业 AI 需求的集中领域相吻合:编程助手已成为开发者中普及最快的 AI 产品类别之一,而智能体系统——能够规划并执行多步骤任务的模型——则是各大 AI 实验室竞争的焦点。
支出规模反映了这一点。Alphabet 已将 2026 年资本支出指引最高设定为 2050 亿美元,这一数字使该公司首次进入自由现金流为负的区间。
竞争压力的来源
此前推出的 Gemini 3.5 Pro 据报道曾因编程相关问题而遭遇延迟。Gemini 4 在一定程度上正是对此的回应。一个明确围绕编程能力构建的模型,针对的正是竞争对手——尤其是 OpenAI 和 Anthropic,其模型在编程基准测试和开发者采用方面一直表现出色——对 Google 以往发布产品造成最有力冲击的领域之一。
追踪 Google 历史训练周期的分析师认为,最有可能的发布窗口是 2026 年底,即 7 月启动预训练约六个月之后。该公司尚未公开披露正式时间表。
接下来的看点,以及为何后训练是关键变量
截至 2026 年 9 月 1 日,尚未发布任何关于 Gemini 4 预训练或后训练时间表的公开基准测试。对于一家在 2025 年和 2026 年初大部分时间里致力于重建开发者对 Gemini 产品线信心的公司而言,这种沉默更像是有纪律的预期管理,而非战略性保密。值得关注的早期信号包括公开基准测试提交、开发者预览版,或整合到 Google 自家产品中——以往 Gemini 版本通常正是通过这些渠道率先亮相。
更广泛的科技行业一直在密切关注 Alphabet 的资本支出轨迹,部分原因是它反映了行业巨头对当前 AI 投资周期还有多大空间的判断。单一公司高达 2050 亿美元的资本支出年度,将对芯片供应商、数据中心建设、能源基础设施以及争夺相同 GPU 产能的初创企业产生连锁影响。