主要来源IT之家
查看原文事件专题 ·多源确认
JetBrains 发布编程模型 Mellum2.1:高负载推理吞吐量接近 Qwen3.5-9B 两倍
JetBrains 于 10 月 8 日发布智能体编程模型 Mellum2.1,延续 12B 混合专家架构、2.5B 活跃参数,采用 Apache 2.0 许可证。该版本将强化学习从短期收尾扩展为训练主体,训练期间在内部基础设施中启动数百万个沙盒、覆盖数千个环境。模型可探索代码库、编辑文件并检查自身修改,能定位失败测试的根因、起草修复方案并验证结果。官方对比测试显示,高负载时其推理吞吐 Token 数接近 Qwen3.5-9B 的两倍,多 Token 预测(MTP)使单请求速度提高约 1.6 倍。Mellum2.1 已上线 Hugging Face,支持本地部署,后续将推出 llama.cpp、Ollama、LM Studio 的 GGUF 版本。
当前结论
JetBrains 开源了新的编程模型 Mellum2.1,专门练了智能体写代码的能力,高负载下吞吐量几乎是 Qwen3.5-9B 两倍,还能本地部署保数据安全。
4 个信源56° AI 热度最后更新 2026/10/9 04:59:08
证据链
4 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。