详情
全球知名开发工具厂商 JetBrains 正式推出面向编程智能体的开源大模型 Mellum2.1。新版本延续 12B 混合专家(MoE)架构、2.5B 活跃参数,依托强化学习全面升级代码智能体能力,高负载下 Token 吞吐量可达同类主流竞品两倍,大幅降低企业私有化部署 AI 编程系统的算力成本。

Mellum2.1 采用 Apache 2.0 协议开源,可本地或云端自主部署。本次升级重点强化预训练后的环境强化学习环节,在训练过程中启动数百万沙盒任务、覆盖数千种仿真环境,补充软件工程、数学推理、工具调用等高质量训练数据,剔除缺陷与无效样本,显著提升模型在真实代码仓库内的自主作业能力。
相较于前代,Mellum2.1 能够深入检索代码库、自主编辑文件并校验修改结果,可定位测试失败根因、生成修复代码并完成验证,适配代码智能体全链路开发工作流。模型搭载多 Token 预测(MTP)技术,单请求场景推理速度提升约 1.6 倍,在并发高负载场景保持稳定输出,解决传统编码大模型延迟高、吞吐有限、部署昂贵的痛点。
除编程任务外,Mellum2.1 同样具备通用推理能力,支持日常问答、复杂数学分步求解,兼顾代码智能子代理、私有开发知识库问答、代码补全、工程脚本生成等场景。开发者、企业团队可基于 Mellum2.1 搭建私有化编程 AI,在保障代码数据隐私前提下,实现开发提效。
Mellum 系列模型的核心目标是面向生产级 AI 工作负载,在保证代码质量的同时压低推理开销。Mellum2.1 的发布,进一步补齐开源编程智能体模型短板,为软件企业、AI 研发团队提供兼顾性能、吞吐与可控性的基础模型选择。
