巴黎的 Mistral AI 于周二发布了 Mistral Large 4,这是一款拥有 1 万亿参数的人工智能模型。参数是这类系统在训练过程中调整的数值,像 ChatGPT 和 Claude 这样的聊天机器人背后就依赖这类模型;通常来说,参数越多,模型可学习的能力越强,但运行成本也更高。
“[Mistral Large 4] 处于开放模型的前沿,也是迄今为止美国或欧洲最强的开放权重模型,”Mistral AI 首席科学家 Guillaume Lample 在 X 上写道。
并不是所有参数都会同时工作。Large 4 采用“专家混合”(mixture of experts)设计,也就是说,模型会把每个问题路由给少数几个专门子网络,因此每次回答只会激活 490 亿个参数。Mistral 上一代旗舰 Large 3 也采用了同样的方式,但其 6750 亿参数中只有 410 亿个会被激活。
“Le Chonk”这个昵称背后也有来历。6 月,在 Mistral 将其 Le Chat 助手更名为 Vibe 之后,Reddit 和 X 上的粉丝虚构出一个名为 Le Chaton Fat 的模型——大致可译为“胖小猫”——并给它设定了 3 万亿参数、每秒 1000 次喵叫,以及一些虚假的基准测试,声称它击败了 Claude Fable 5。

CEO Arthur Mensch 也跟着玩梗,回复称这款模型其实叫“le gros chaton”,法语意为“胖小猫”。随后,Mistral 在其 Vibe 网站上加了一只卡通猫。如今,该公司正式发布帖把这款模型写成“非常正式地”叫 le Chonk。
Mistral 销售的是“主权 AI”——即国家或公司可以拥有并自行运行、而无需把数据交给外部公司的模型。沙特阿拉伯国家支持的 HUMAIN 就在 8 月与这家公司签署了一份价值数亿欧元的协议,原因正是这一点。
Le Chonk 的定价为每百万输入 tokens 1.36 美元、每百万输出 tokens 4.18 美元。tokens 是 AI 公司按此计费的文本单位,大致相当于每三个词中的四分之三。Claude Opus 5.5 的收费为每百万输入 tokens 4 美元、每百万输出 tokens 20 美元,而 GPT-6 Astra 的收费为 10 美元和 50 美元。
这意味着 Large 4 的输入价格大约只有 Opus 5.5 的三分之一,输出价格约为五分之一;与 Astra 相比,则大约是七分之一和十二分之一。
基准测试显示了什么
Mistral 的公告主要将 Large 4 与中国的开放权重模型进行比较——DeepSeek V4 Pro、Kimi K3、GLM-5.3 和 Qwen3.8 Max——而“开放权重”意味着任何人都可以下载并运行该模型。Claude 和 GPT 只出现在少数几项对比中,而最新的 Claude Opus 5.5 仅出现在一项网络安全相关说法里。
在 Surge AI 对编码质量进行的盲测人工评估中,Mistral Large 4 在 5 个模型中排名第二,得分 3.74 分(满分 5 分),落后于 Claude Opus 5 的 4.22 分。
在 DeepSWE 1.1 上——这是开发者在评估模型编码能力时常会查看的基准之一——Large 4 得分 62 分,超过 GLM-5.3 的 61 分和 DeepSeek V4 Pro 的 57 分,但落后于 Kimi K3 的 68 分。Datacurve 自己的排行榜上,GPT-6 Astra 和 Claude Opus 5 都是 74 分。
Mistral 表示,将在 10 月底前公布 Large 4 的权重——也就是让模型运作的训练后参数——这将使外部开发者能够下载该模型,并自行验证这些说法。











