深度分析 利用 LoRA 與 3D 代理實現姿態可控的影像插入—DIRECT 框架解析 物件插入技術近期透過參考式影像生成取得突破,但多數仍停留在 2D 平面,缺乏對 3D 姿態的明確控制。研究團隊提出 DIRECT 框架,將插入條件分解為外觀引導、幾何引導與場景上下文,並以使用者調整的 3D 代理作為幾何條件,透過獨立的 LoRA 通道注入,避免特徵混雜,同時保留參考物件的細節、遵循指定姿態並與背景融合。