JetBrains 发布 Mellum 2.1:称高负载推理吞吐量接近 Qwen3.5-9B 的两倍
JetBrains 发布了采用 Apache 2.0 许可证、主打智能体编程的 Mellum 2.1。该模型延续 Mellum 2 的混合专家架构,总参数量为 120 亿,活跃参数量为 25 亿。此次更新扩展了强化学习训练,并补充数学、算法竞赛、科学、工具使用和软件工程等领域的数据。JetBrains 表示,模型能够探索代码库、编辑文件并检查修改结果。多 Token 预测可使单请求速度提升约 1.6 倍。根据 JetBrains 的评估,高负载时 Mellum 2.1 的推理 Token 吞吐量接近 Qwen3.5-9B 的两倍。该模型现已登陆 Hugging Face,支持本地或自有基础设施部署。
本文来源:IT之家,仅供学习参考,版权归原作者所有。