深度分析
OpenAI 發布全雙工語音模型 GPT‑Live‑1:即時翻譯與視覺化回應
OpenAI於2026年推出全雙工語音模型GPT‑Live‑1,可同時說話與聆聽,並減少打斷使用者。模型會自動切換至最佳文字模型,支援即時翻譯與視覺化回應,提升對話自然度與安全性。同時能即時顯示天氣、股價與運動比分等視覺資訊,並在高風險對話中自動停止或轉介危機支援。
深度分析
OpenAI於2026年推出全雙工語音模型GPT‑Live‑1,可同時說話與聆聽,並減少打斷使用者。模型會自動切換至最佳文字模型,支援即時翻譯與視覺化回應,提升對話自然度與安全性。同時能即時顯示天氣、股價與運動比分等視覺資訊,並在高風險對話中自動停止或轉介危機支援。
深度分析
全雙工語音模型需精準輪替,ASPIRin 以行動空間投射將詞彙映射為說話或沉默二元狀態,並使用 GRPO 結合規則獎勵平衡中斷與延遲。實驗顯示其可降低重複 n-gram 超過 50%,提升對話互動性。