JetBrains 发布 Mellum2.1 编程模型:高负载吞吐近 Qwen3.5-9B 两倍
10月9日,JetBrains 上线 Mellum2.1 模型,重点增强智能体编程能力。该模型延续 Mellum2 的 12B 混合专家架构,拥有 2.5B 活跃参数,继续采用 Apache 2.0 许可证发布。主要升级在预训练后的强化学习阶段,从短期收尾扩展为训练主体,并在数学、算法竞赛、科学、工具使用和软件工程等任务补充训练数据。
升级后,模型可探索代码库、编辑文件并检查自身修改,能识别失败测试根因、起草修复方案并验证结果。性能上,高负载时推理吞吐 Token 数量接近 Qwen3.5-9B 的两倍,单请求场景因多 Token 预测使速度提高约 1.6 倍。模型现已登陆 Hugging Face,后续将推出面向 llama.cpp、Ollama 和 LM Studio 的 GGUF 版本。