跳到主要內容
2026-09-11 日報
模型發布

OpenAI API 推出 GPT-Live-1:支援全雙工語音對話,延遲降至 0.8 秒

OpenAI News綜合 2 家報導一手來源
核實資料不足

來源為發布方或研究資料;不代表所有主張已獲獨立核實。

查證回合用盡,未形成有依據結論

OpenAI 正式在 API 推出 GPT-Live-1 模型,提供支援全雙工(full-duplex)的語音對話能力,允許模型同時聆聽與說話。該模型具備更強的指令遵循能力,並支援自訂語音與電話通訊功能。 開發者可根據任務的推理深度、速度與成本需求,將 GPT-Live-1 搭配不同的後端模型使用。目前 API 定價為每分鐘 0.05 美元。 在官方評測中,GPT-Live-1 較前代 GPT-Realtime-2.1 大幅提升:全雙工互動測試得分從 45.4% 提升至 80.1%,輪流對話延遲從 1.4 秒降至 0.8 秒,工具呼叫準確率則從 60% 躍升至 87%。目前該語音模型已在 ChatGPT 內部運行,Yelp 技術長 Alex Levy 表示,公司已將其應用於電話訂位服務,並獲得更好的通話處理效果。
讀原始報導

背景

全雙工(Full-duplex)通訊系統允許連線雙方在兩個方向上同時進行通訊。GPT-Live-1 將 ChatGPT 這種自然且可同時雙向對話的能力引入 API 中,讓開發者能更精細地控制語音代理的說話與行為方式。

來源