JetBrains 发布开源编程模型 Mellum2.1,面向编程智能体和快速子智能体场景。该公司称,Mellum2.1 为 120 亿参数的混合专家思维模型,每令牌激活 25 亿参数。
基准测试方面,Mellum2.1 在 17 项测试中的 15 项超过前代 Mellum2,并在 LiveCodeBench v6 等多项编程基准上领先 Qwen3.5-9B。
Mellum2.1 以 Apache 2.0 许可发布
该模型已在 Hugging Face 以 Apache 2.0 许可发布,架构与 Mellum2 保持一致。JetBrains 表示,主要升级来自在真实软件环境中进行的强化学习训练。
按官方说法,这使 Mellum2.1 成为一个可自托管的小型模型,可以探索代码仓库、编辑文件,并检查自己的修改。
支持用户自有 GPU 部署
JetBrains 表示,Mellum2.1 可在用户自己的 GPU 上通过 vLLM 或 SGLang 运行,速度测试基于 1 块 NVIDIA H200。模型上下文长度为 131,072 个令牌,主要面向智能体工作、通用推理助手和私有自托管部署三种用途。
这则消息由 MarkTechPost 提及,Techub 进行了整理发布。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

