深度分析
IBM Granite Embedding Multilingual R2:以 ModernBERT 架構實現 32K 上下文與多國語言檢索
IBM 推出新一代多國語言向量化模型 Granite Embedding Multilingual R2,旨在解決多國語言檢索中模型大小與語言覆蓋率的矛盾。該模型基於 ModernBERT 構建,將上下文窗口擴展至 32K tokens,並針對 52 種語言與程式碼進行強化訓練。測試結果顯示 97M 小模型在檢索品質上超越多個 300M 級別模型,311M 版本則透過 Matryoshka 技術降低儲存成本,為企業級多國語言 RAG 部署提供高效能且低成本的解決方案。