JetBrains 发布开源编程模型 Mellum2.1。与今年 6 月推出的 Mellum2 相比,新版总参数仍为 120 亿,每次生成激活 25 亿,但在查找代码问题、修改文件和检查结果方面表现更强。
JetBrains 这次没有调整模型架构,主要通过强化学习提升能力。团队称,训练过程中在数千种环境里运行了数百万次沙盒任务。模型会在真实代码仓库中调用终端和文件编辑工具,成功通过测试后获得奖励。
按 JetBrains 自测结果,Mellum2.1 在 SWE-bench Verified 这项真实软件问题修复测试中的成功率,从上一版的 2% 提升到 47%,略低于 Qwen3.5-9B 的 50%。不过在 LiveCodeBench v6 编程测试中,Mellum2.1 得分 82%,高于 Qwen3.5-9B 的 75.4%。
JetBrains 还表示,在单张 H200 上高负载运行时,新模型的输出吞吐量接近 Qwen3.5-9B 的两倍。
目前,Mellum2.1 的模型权重及 GGUF 量化版已在 Hugging Face 开放,采用 Apache 2.0 许可,开发者可以本地部署。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

