速報 新穎預先註冊協議防止大型語言模型研究 p‑hack 大型語言模型(LLM)在資料生成與標註上越來越常見,但研究者可透過調整提示詞、解碼參數或輸出格式來進行 p‑hack,導致結果不可靠。研究團隊提出一套預先註冊實驗與可用模型的流程:先在現有模型上確定分析方法,將實驗計畫與未來可接受的模型清單公開登記,然後在登記後首個符合條件的新模型上執行確認分析。