新闻宏观经济Mistral AI 发布万亿参数模型 Mistral Large 4,官方昵称'Le Chonk'

Mistral AI 发布万亿参数模型 Mistral Large 4,官方昵称'Le Chonk'

作者: Decrypt·

要点速览

  • •Mistral Large 4 是一个1万亿参数的混合专家模型,它将每次查询路由到专门的子网络,每次回答仅激活490亿参数,公司已正式将其昵称为 Le Chonk。
  • •该模型价格为每百万输入 token 1.36美元、每百万输出 token 4.18美元,输入价格约为 Claude Opus 5.5 的三分之一,输出价格约为其五分之一。
  • •Mistral 表示将在10月底之前发布 Large 4 的权重,让客户能够在自己的基础设施上运行该模型,这也是其主权 AI 定位的一部分,其中包括与沙特阿拉伯 HUMAIN 价值数亿欧元的合作协议。
  • •在第三方评估中,Mistral Large 4 在 Surge AI 的盲测编程评估中以3.74分(满分5分)排名第二,落后于 Claude Opus 5,并在 AutomationBench 上得59.9分,远低于 Gemini 4 Argon 的77.5分。
  • •此次发布是 Mistral 亿欧元(33.7亿美元)D 轮融资所资助路线图上的首个里程碑,该轮融资于9月完成,估值超过210亿欧元,由三星领投。
Mistral AI 发布万亿参数模型 Mistral Large 4,官方昵称'Le Chonk'

总部位于巴黎的 Mistral AI 于10月6日(周二)发布了 Mistral Large 4,推出这款1万亿参数的 AI 模型,公司如今"非常正式"地将其昵称为 Le Chonk。该模型定价为每百万输入 token 1.36美元、每百万输出 token 4.18美元,Mistral 表示将在10月底之前发布模型权重。

参数是模型在训练过程中调整的可变数值——参数越多,通常意味着学习能力越强,运行成本也越高。这种规模的系统正是 ChatGPT 和 Claude 等聊天机器人背后的技术类型。

混合专家架构

并非所有参数都同时工作。Large 4 采用"混合专家"(mixture of experts)设计,模型将每个问题路由到少数专门的子网络,因此每次回答只激活490亿参数。保持较低的活动参数量有助于控制运行成本。Mistral 的上一代旗舰模型 Large 3 也采用同样方式,在6750亿总参数中激活410亿。

"[Mistral Large 4] 处于开放模型的前沿,是迄今为止美国或欧洲最强的开放权重模型,"Mistral AI 首席科学家 Guillaume Lample 在 X 上写道。

在 Finance Agent v2 上,发布图表显示 Large 4 得分54.7——领先于得53.5的 GPT-6 Astra,但落后于得58.6的 Claude Opus 5.5。

定价 undercut 竞争对手

Mistral 按 token 计费,token 是 AI 公司收费的文本片段——每个大约相当于四分之三个单词。以每百万输入 token 1.36美元、每百万输出 token 4.18美元的价格计算,Large 4 的输入价格约为 Claude Opus 5.5 的三分之一,输出价格约为其五分之一。Opus 5.5 的收费分别为4美元和20美元,而 GPT-6 Astra 为10美元和50美元——这使得 Large 4 的价格约为 Astra 的七分之一和十二分之一。由于按 token 收费随使用量递增,对于运行高负载工作负载的开发者来说,这些差距会迅速累积。

"Le Chonk" 昵称的由来

这个昵称有一段背景故事。今年6月,Mistral 将其 Le Chat 助手更名为 Vibe 之后,Reddit 和 X 上的粉丝们虚构了一个名为 Le Chaton Fat 的模型——大致意为"肥小猫"——拥有30万亿参数、每秒1000声喵叫,以及声称其击败 Claude Fable 5 的虚假基准测试。

The French Goverment needs to STOP Le Chaton Fat before it's too late. This is the FAT takeoff we've been warned against for years! pic.twitter.com/VoaBPJmfBT

— GLIF (@heyglif) June 15, 2026

CEO Arthur Mensch 顺势配合,回复称该模型实际上名为"le gros chaton",法语意为"大猫咪"。Mistral 随后在 Vibe 网站上添加了一只卡通猫。其正式的发布文章现在"非常正式"地将该模型列为 Le Chonk。

主权 AI 与新融资

Mistral 主打"主权 AI"——即一个国家或公司可以拥有并自行运行、无需将数据交给外部公司的模型。沙特阿拉伯国家支持的 HUMAIN 正是基于这一原因,于8月与 Mistral 签署了价值数亿欧元的合作协议。计划中的权重发布也服务于同样的定位:公开权重让客户能够在自己控制的基础设施上运行该模型。

9月,Mistral 完成了30亿欧元(33.7亿美元)的 D 轮融资——即公司向投资者出售股份的融资轮——估值超过210亿欧元(236亿美元),由三星领投。公司表示,Large 4 是这笔资金所资助路线图上的首个里程碑。

基准测试结果如何

Mistral 的发布公告主要将 Large 4 与中国的开放权重模型进行对比——DeepSeek V4 Pro、Kimi K3、GLM-5.3 和 Qwen3.8 Max。"开放权重"意味着任何人都可以下载并运行该模型。Claude 和 GPT 模型仅出现在少数几项对比中,而最新的 Claude Opus 5.5 只出现在一项网络安全声明中。发布文章中的图表由厂商自行编制,这也是第三方评分往往更受关注的原因。

在 Surge AI 主办的编程质量盲测人工评估中,Mistral Large 4 在五个模型中排名第二,得分3.74(满分5分),落后于得4.22的 Claude Opus 5。

由 Artificial Analysis 运营的 AutomationBench 让 AI 在模拟商业软件——财务、人力资源、销售和客服——中完成657项任务,并根据其完成每项任务目标的比例打分,违反规则则不得分。Large 4 得分59.9分。在同一基准测试中,Claude Sonnet 5.5 得71.8分,Opus 5.5 得69.5分,Gemini 4 Argon 以77.5分位居榜首。

在 DeepSWE 1.1 上——开发者评估模型编程能力时常参考的基准测试——Large 4 得分62,领先于得61分的 GLM-5.3 和得57分的 DeepSeek V4 Pro,但落后于 Kimi K3 的68分。Datacurve 自己的排行榜则将 GPT-6 Astra 和 Claude Opus 5 均列为74分。

Mistral 表示将在10月底之前发布 Large 4 的权重——即让模型运作的经过训练的数值,这将允许外部开发者下载该模型并亲自验证这些声明。