深度分析 JetBrains 推出 Mellum2:12 億參數 MoE 高效模型,降低推理延遲與成本 JetBrains於2026年6月推出Mellum2,12億參數的MoE模型,針對文字與程式碼工作負載設計。模型每個token只激活約2.5億參數,推理速度超過同規模開源模型兩倍。此特性使其在路由、RAG、子代理與私有部署等高頻AI任務上具備成本與效能優勢。