深度分析 「SeeSE3」:自監督視覺基礎模型中隱含的 SE(3) 空間結構探討 研究探討視覺基礎模型是否能在僅被動圖像輸入下自發形成與 SE(3) 變換群一致的三維空間結構,透過拓撲對齊與 Poincaré 適配器測試,結果顯示自監督模型可在潛在空間中解碼相機運動,為無重建視覺導航提供新方向。跨模型比較指出 DINOv2、DINOv3 的對齊分數接近專門幾何模型,顯示被動學習亦能捕捉空間同質性。