Mistral AI发布万亿参数模型 Large 4,正式冠名“Le Chonk”

Mistral AI发布万亿参数模型 Large 4,正式冠名“Le Chonk”

N
News Editor
2026-10-06 17:22:54
总部位于巴黎的 Mistral AI 于周二发布 Mistral Large 4,这是一款拥有 1 万亿参数的新模型,但单次回答仅激活 490 亿参数。公司将其称为美国和欧洲最强的开放权重模型之一,并披露该模型定价明显低于 Claude Opus 5.5 和 GPT-6 Astra。Mistral 还表示,将在 10 月底前开放 Large 4 的模型权重,供外部开发者下载和验证。

总部位于巴黎的 Mistral AI 于周二发布 Mistral Large 4。这款新模型拥有 1 万亿参数,属于驱动 ChatGPT、Claude 这类聊天机器人的同类系统。参数是模型在训练过程中调整的数值,参数规模通常越大,学习能力越强,运行成本也越高。

Mistral AI发布万亿参数模型 Large 4,正式冠名“Le Chonk” 2

Mistral AI 首席科学家 Guillaume Lample 在 X 上写道:「[Mistral Large 4] 处于开放模型前沿,也是迄今美国或欧洲最强的开放权重模型。」

采用专家混合架构,单次回答激活 490 亿参数

并不是全部参数都会在每次推理时同时工作。Large 4 采用“专家混合”(mixture of experts)设计,也就是把每个问题路由给少数几个专门的子网络处理,因此每次回答实际激活的参数量为 490 亿。

Mistral 上一代旗舰模型 Large 3 也采用了相同思路:总参数为 6750 亿,其中单次回答激活 410 亿参数。

“Le Chonk”名称来自社区玩梗

“Le Chonk”这个昵称背后有一段来历。6 月,Mistral 将其 Le Chat 助手更名为 Vibe 后,Reddit 和 X 上的用户虚构出一个名为 Le Chaton Fat 的模型,意思大致是“胖小猫”。这个虚构模型被设定为拥有 30 万亿参数、每秒 1000 次喵叫,还有一组伪造基准测试,声称它击败了 Claude Fable 5。

随后,CEO Arthur Mensch 也参与了这场玩笑,回复称该模型真正的名字其实是「le gros chaton」,法语意为“大猫崽”。之后,Mistral 在 Vibe 网站上加入了一只卡通猫,而这次真实发布的公告则把模型“非常正式地”命名为 le Chonk。

主打“主权 AI”,曾与 HUMAIN 签下数亿欧元协议

Mistral 销售的是“主权 AI”,也就是国家或企业可以自行拥有并运行的模型,无需把数据交给外部公司。报道提到,沙特阿拉伯国家支持的 HUMAIN 正是出于这一原因,在 8 月与 Mistral 签署了一份价值数亿欧元的协议。

融资方面,Mistral 在 9 月完成了 30 亿欧元(33.7 亿美元)的 D 轮融资,估值超过 210 亿欧元(236 亿美元),由 Samsung 领投。Mistral 表示,Large 4 是这笔资金所支持路线图上的第一个里程碑。

定价低于 Claude Opus 5.5 和 GPT-6 Astra

Mistral Large 4 的价格为每百万输入 token 1.36 美元、每百万输出 token 4.18 美元。token 是 AI 公司计费使用的文本单位,长度大约相当于四分之三个单词。

作为对比,Claude Opus 5.5 的收费为每百万输入 token 4 美元、每百万输出 token 20 美元;GPT-6 Astra 的收费为每百万输入 token 10 美元、每百万输出 token 50 美元。

按这一标准计算,Large 4 的输入价格约为 Opus 5.5 的三分之一,输出价格约为五分之一;与 Astra 相比,输入价格约为七分之一,输出价格约为十二分之一。

基准测试对比集中在中国开放权重模型

Mistral 在公告中主要将 Large 4 与中国开放权重模型进行对比,包括 DeepSeek V4 Pro、Kimi K3、GLM-5.3 和 Qwen3.8 Max。所谓“开放权重”,是指任何人都可以下载并运行该模型。

Claude 和 GPT 只出现在少数几项比较中,而最新的 Claude Opus 5.5 仅在一项网络安全相关表述中出现。

Surge AI 盲测:编码质量排名第二

在由 Surge AI 进行的编码质量盲测中,Mistral Large 4 在 5 个模型中排名第二,得分为 5 分制下的 3.74 分,落后于 Claude Opus 5 的 4.22 分。

AutomationBench:得分 59.9

AutomationBench 会让 AI 在模拟商业软件中完成 657 项任务,覆盖财务、人力资源、销售和支持等场景,并按每项任务目标完成比例评分;如果违反规则,则该任务记 0 分。Large 4 在这项测试中得到 59.9 分。

Artificial Analysis 榜单显示,在同一基准上,Claude Sonnet 5.5 得分 71.8,Opus 5.5 得分 69.5,Gemini 4 Argon 以 77.5 分位居榜首。

DeepSWE 1.1:高于 GLM-5.3 和 DeepSeek V4 Pro,低于 Kimi K3

在开发者常用来评估编码能力的 DeepSWE 1.1 基准上,Large 4 得分 62。这个成绩高于 GLM-5.3 的 61 分和 DeepSeek V4 Pro 的 57 分,但低于 Kimi K3 的 68 分。

Datacurve 自有排行榜显示,GPT-6 Astra 和 Claude Opus 5 的得分均为 74。

计划在 10 月底前开放模型权重

Mistral 表示,将在 10 月底前发布 Large 4 的模型权重,也就是让模型运行的训练后参数。届时,外部开发者可以下载该模型,并自行测试这些性能说法。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。