深度分析 以 IRT 2PL 模型結合 METR 人類時間,BRIDGE 框架實現跨領域 AI 能力時間預測 隨著AI系統在真實場域的應用增多,傳統以人類完成時間為基準的評估成本高且難以擴展。研究提出BRIDGE框架,利用二參數邏輯IRT從模型回應推估隱含難度,再以人類時間校正,可僅靠模型表現預測新基準的人類完成時間,並預測能力每六個月翻倍,為AI評估提供新方向。