IT之家 · 智能时代T2·78 分
JetBrains 发布 Mellum2.1:RL 强化智能体编程,高负载吞吐近 Qwen3.5-9B 两倍
原文标题:JetBrains 编程 AI 模型 Mellum2.1 发布:高负载推理吞吐量近 Qwen3.5-9B 两倍
- Mellum2.1 延续 12B MoE 架构(2.5B 活跃参数),Apache 2.0 许可开源。
- 核心升级在于将强化学习从收尾环节扩展为训练主体,显著提升根因分析与修复验证能力。
- 高负载下推理吞吐量接近 Qwen3.5-9B 的两倍,单请求速度提升约 1.6 倍。