JetBrains 发布开源代码智能体模型 Mellum2.1
JetBrains 发布了 Mellum2.1——今年 6 月开源的 Mellum2 的下一代版本。架构没变:依然是 12B 混合专家、仅 2.5B 激活参数,Apache 2.0 协议。变化全部在预训练之后:一个夏天在真实软件环境里做了数百万次沙盒强化学习,让它能在代码仓库里探索、改代码、自己检查修改。

事件经过
据 JetBrains 官方博客,Mellum2 速度够快,但在仓库级任务上达不到 JetBrains 想要的水平。Mellum2.1 把强化学习从训练末尾的"短收尾"变成了训练的主体:在自建的数千个 RL 环境里跑了数百万次沙盒,新增数学、竞赛编程、科学、工具调用和软件工程等 RL 任务,并对开源数据做了严格过滤(坏测试、不可验证答案、过易或过难的任务都被剔除)。
官方对比显示,在智能体式编程(agentic coding)上 Mellum2.1 相对 Mellum2 进步最大,同时在代码、竞赛编程、数学、工具调用和通用知识上全面提升;同级别对比了 Qwen3.5-9B 和 Gemma 4 E4B。速度上架构未动,多 token 预测(MTP)加持下,高负载时它是同组里最快的模型,吞吐接近 Qwen3.5-9B 的两倍,单请求约快 1.6 倍。
模型已上 Hugging Face;llama.cpp / Ollama / LM Studio 的 GGUF 构建以及 vLLM 的 MTP 推测解码头还在路上。JetBrains 将它定位为面向在自有基础设施上构建代码智能体、子智能体和 AI 工具的开发者,代码和数据由开发者自行掌控。
为什么重要
Mellum2.1 架构不变(12B 混合专家、2.5B 激活参数),在数千个 RL 环境里跑了数百万次沙盒;高负载吞吐接近 Qwen3.5-9B 两倍。
相关公司阿里巴巴
评论
今天
10月12日 星期一- 早报GSK 扩大与 Chai 合作:AI 设计通过湿实验室验证
共 9 条 · 10月11日
- 三问
- 预测
