JetBrains 发布开源模型 Mellum2.1,一款面向编程智能体与快速子智能体的 12B 混合专家(MoE)推理模型,每 token 激活 2.5B 参数,以 Apache 2.0 协议在 Hugging Face 上开放权重。其架构与 Mellum2 保持一致,升级几乎全部来自真实软件环境中的强化学习,使这一小型可自托管模型能够探索代码仓库、编辑文件并自查改动。性能上,它在列出的 17 项基准中 15 项优于 Mellum2,LiveCodeBench v6 得分 82.0,领先 Qwen3.5-9B 和 Gemma 4 E4B;但在 Terminal-Bench 2.1 等困难智能体任务上仅得 17.4,仍落后于 Qwen3.5-9B。该模型支持 131,072 token 上下文,可通过 vLLM、SGLang 自托管,并提供 GGUF 版本,兼顾较强编程能力与高吞吐。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅