JetBrains开源 Mellum2.1,LiveCodeBench 成绩超过 Qwen3.5-9B

JetBrains开源 Mellum2.1,LiveCodeBench 成绩超过 Qwen3.5-9B

N
News Editor
2026-10-09 08:06:01
JetBrains 发布开源编程模型 Mellum2.1,总参数仍为 120 亿、单次生成激活 25 亿。公司称,新版在不改动模型架构的情况下,主要通过强化学习提升代码排错、改文件和结果检查能力。JetBrains 自测显示,Mellum2.1 在 SWE-bench Verified 的成功率从 2% 升至 47%,在 LiveCodeBench v6 中得分 82%,高于 Qwen3.5-9B 的 75.4%。模型权重和 GGUF 量化版已在 Hugging Face 以 Apache 2.0 许可开放。

JetBrains 发布开源编程模型 Mellum2.1。与今年 6 月推出的 Mellum2 相比,新版总参数仍为 120 亿,每次生成激活 25 亿,但在查找代码问题、修改文件和检查结果方面表现更强。

JetBrains 这次没有调整模型架构,主要通过强化学习提升能力。团队称,训练过程中在数千种环境里运行了数百万次沙盒任务。模型会在真实代码仓库中调用终端和文件编辑工具,成功通过测试后获得奖励。

按 JetBrains 自测结果,Mellum2.1 在 SWE-bench Verified 这项真实软件问题修复测试中的成功率,从上一版的 2% 提升到 47%,略低于 Qwen3.5-9B 的 50%。不过在 LiveCodeBench v6 编程测试中,Mellum2.1 得分 82%,高于 Qwen3.5-9B 的 75.4%。

JetBrains 还表示,在单张 H200 上高负载运行时,新模型的输出吞吐量接近 Qwen3.5-9B 的两倍。

目前,Mellum2.1 的模型权重及 GGUF 量化版已在 Hugging Face 开放,采用 Apache 2.0 许可,开发者可以本地部署。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。