法国 AI 公司 Mistral 发布新旗舰模型 Mistral Large 4,内部昵称为「Le Chonk」。该模型采用 MoE 架构,总参数达到 1.05 万亿,但每次推理只激活 490 亿参数。
Large 4 原生支持图文输入,上下文长度最高为 100 万 token。Mistral 已开放 API 预览,并计划在 10 月 27 日公开模型权重。
官方给出的主要评测数据
Mistral 表示,Large 4 是目前美国和欧洲开发的综合表现最强开放权重模型。按照官方披露的数据,Large 4 在 DeepSWE v1.1 软件工程评测中得到 62%。在其对比表中,GLM-5.3 为 61%,DeepSeek V4 Pro 为 57%,Qwen 3.8 Max 为 51%。
在金融评测 Finch 中,Large 4 得分为 67%,与 DeepSeek V4 Pro 持平;在卫星图目标定位评测 DIOR-RSVG 中,Large 4 得到 73%,高于 GPT-6 Astra 的 68%。
成绩口径存在差异
不过,这批成绩目前主要来自 Mistral 自测,并非统一口径。智谱在发布 GLM-5.3 时,曾在同一个 DeepSWE v1.1 上公布 66.9% 的成绩;Kimi K3 则达到 67.5%,两者都高于 Large 4 的 62%。不同团队使用的测试配置和运行方式可能并不相同。
训练资源与欧洲部署卖点
Mistral 称,Large 4 为从零训练完成。公司使用约 4000 块 Nvidia Grace Blackwell GPU,在欧洲自有数据中心训练约两个月。
Mistral 也将「欧洲自主」作为卖点之一。按照其说法,模型训练、API 服务以及未来的自主部署,都可以留在欧洲基础设施上。

