深度分析
JetBrains 推出 Mellum2:12 億參數 MoE 高效模型,降低推理延遲與成本
JetBrains於2026年6月推出Mellum2,12億參數的MoE模型,針對文字與程式碼工作負載設計。模型每個token只激活約2.5億參數,推理速度超過同規模開源模型兩倍。此特性使其在路由、RAG、子代理與私有部署等高頻AI任務上具備成本與效能優勢。
深度分析
JetBrains於2026年6月推出Mellum2,12億參數的MoE模型,針對文字與程式碼工作負載設計。模型每個token只激活約2.5億參數,推理速度超過同規模開源模型兩倍。此特性使其在路由、RAG、子代理與私有部署等高頻AI任務上具備成本與效能優勢。
深度分析
研究探討在純神經模組化架構中學習完整Kleene三值邏輯,THEIA透過四個專屬引擎處理算術、序、集合與命題,最終在邏輯模組整合。2M樣本訓練下達到全部規則覆蓋,推論速度比同規模Transformer快5.6倍。