深度分析 微調 Qwen3-VL-Embedding-2B 以 Flash Attention 2 與 MatryoshkaLoss 提升視覺文件檢索效能 研究者以Qwen3-VL-Embedding-2B為基礎,透過SentenceTransformers微調視覺文件檢索,NDCG@10從0.888提升至0.947。微調同時使用MatryoshkaLoss支援多維度嵌入,512維仍保高精度,顯示開源模型在成本與部署彈性上具優勢。