深度分析 JetBrains 發布 12 B MoE 模型 Mellum2:雙倍推理速度,聚焦文字與程式碼工作負載 JetBrains 於 2026 年 6 月正式發布 Mellum2,這是一款 12 B 參數的 Mixture‑of‑Experts(MoE)模型,專為文字與程式碼工作負載設計。模型每個 token 僅啟動約 2.5 B 參數,使推理速度較同規模開源模型提升逾兩倍,且採用 Apache 2.0 授權。