JetBrains 发布 Mellum2.1 编程模型:高负载吞吐近 Qwen3.5-9B 两倍

2026-10-09 16:03:50   |   微观猎人   |   4305

10月9日,JetBrains 上线 Mellum2.1 模型,重点增强智能体编程能力。该模型延续 Mellum2 的 12B 混合专家架构,拥有 2.5B 活跃参数,继续采用 Apache 2.0 许可证发布。主要升级在预训练后的强化学习阶段,从短期收尾扩展为训练主体,并在数学、算法竞赛、科学、工具使用和软件工程等任务补充训练数据。

升级后,模型可探索代码库、编辑文件并检查自身修改,能识别失败测试根因、起草修复方案并验证结果。性能上,高负载时推理吞吐 Token 数量接近 Qwen3.5-9B 的两倍,单请求场景因多 Token 预测使速度提高约 1.6 倍。模型现已登陆 Hugging Face,后续将推出面向 llama.cpp、Ollama 和 LM Studio 的 GGUF 版本。

特别提醒:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字、图片等内容的真实性、完整性、及时性本站不作任何保证或承诺,请自行核实相关内容。本站不承担此类作品侵权行为的直接责任及连带责任。如若本网有任何内容侵犯您的权益,请及时发送相关信息至bireading@163.com,本站将会在48小时内处理完毕。

JetBrains 发布 Mellum2.1 编程模型:高负载吞吐近 Qwen3.5-9B 两倍

2026-10-09 16:03:50 浏览量: 4305 作者: 微观猎人

10月9日,JetBrains 上线 Mellum2.1 模型,重点增强智能体编程能力。该模型延续 Mellum2 的 12B 混合专家架构,拥有 2.5B 活跃参数,继续采用 Apache 2.0 许可证发布。主要升级在预训练后的强化学习阶段,从短期收尾扩展为训练主体,并在数学、算法竞赛、科学、工具使用和软件工程等任务补充训练数据。

升级后,模型可探索代码库、编辑文件并检查自身修改,能识别失败测试根因、起草修复方案并验证结果。性能上,高负载时推理吞吐 Token 数量接近 Qwen3.5-9B 的两倍,单请求场景因多 Token 预测使速度提高约 1.6 倍。模型现已登陆 Hugging Face,后续将推出面向 llama.cpp、Ollama 和 LM Studio 的 GGUF 版本。

,

Copyright ©2018 铋读网 All Rights Reserved.

京ICP备18051707号

京公网安备 11011302001633号