Mistral 发布 Large 4:1.05 万亿参数,10 月 27 日开放权重

Mistral 发布 Large 4:1.05 万亿参数,10 月 27 日开放权重

N
News Editor
2026-10-06 14:31:00
法国 AI 公司 Mistral 发布旗舰模型 Mistral Large 4,采用 MoE 架构,总参数 1.05 万亿,单次推理激活 490 亿参数,支持图文输入和最长 100 万 token 上下文。API 已开放预览,模型权重计划于 10 月 27 日公开。Mistral 将其称为美欧开发中综合表现最强的开放权重模型,但目前披露的多项成绩主要来自公司自测,且在 DeepSWE v1.1 上低于智谱 GLM-5.3 和 Kimi K3 已公布结果。

法国 AI 公司 Mistral 发布新旗舰模型 Mistral Large 4,内部昵称为「Le Chonk」。该模型采用 MoE 架构,总参数达到 1.05 万亿,但每次推理只激活 490 亿参数。

Large 4 原生支持图文输入,上下文长度最高为 100 万 token。Mistral 已开放 API 预览,并计划在 10 月 27 日公开模型权重。

官方给出的主要评测数据

Mistral 表示,Large 4 是目前美国和欧洲开发的综合表现最强开放权重模型。按照官方披露的数据,Large 4 在 DeepSWE v1.1 软件工程评测中得到 62%。在其对比表中,GLM-5.3 为 61%,DeepSeek V4 Pro 为 57%,Qwen 3.8 Max 为 51%。

在金融评测 Finch 中,Large 4 得分为 67%,与 DeepSeek V4 Pro 持平;在卫星图目标定位评测 DIOR-RSVG 中,Large 4 得到 73%,高于 GPT-6 Astra 的 68%。

成绩口径存在差异

不过,这批成绩目前主要来自 Mistral 自测,并非统一口径。智谱在发布 GLM-5.3 时,曾在同一个 DeepSWE v1.1 上公布 66.9% 的成绩;Kimi K3 则达到 67.5%,两者都高于 Large 4 的 62%。不同团队使用的测试配置和运行方式可能并不相同。

训练资源与欧洲部署卖点

Mistral 称,Large 4 为从零训练完成。公司使用约 4000 块 Nvidia Grace Blackwell GPU,在欧洲自有数据中心训练约两个月。

Mistral 也将「欧洲自主」作为卖点之一。按照其说法,模型训练、API 服务以及未来的自主部署,都可以留在欧洲基础设施上。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。