深度分析 SlideFormer:單GPU異構協同設計實現高效大型語言模型微調 隨著LLM規模持續擴大,單GPU微調面臨記憶體瓶頸。SlideFormer採用層滑動架構、輕量非同步引擎與異構記憶體管理,將GPU與CPU、NVMe資源協同運作,實現單RTX4090可微調123B以上模型,效能提升1.4至6.3倍,記憶體使用減半,同時支援8倍批次大小與6倍模型規模,且在NVIDIA與AMD GPU上保持超過95%峰值效能。