跳到主要內容
2026-08-04 日報
開發生態

OpenAI六個月重建語音架構,GPT-Live可邊說邊聽

OpenAI News綜合 2 家報導一手來源
尚未逐項核實

來源為發布方或研究資料;不代表所有主張已獲獨立核實。

OpenAI在六個月內打造GPT-Live,採用無需輪流發言的語音模型與低延遲架構,讓使用者能與AI持續進行更快速、自然的語音互動。為使系統能在ChatGPT規模下自然運作,OpenAI從用戶端到模型重建整套語音技術堆疊,使音訊可連續流動,GPT-Live也能在說話時同步聆聽,避免較深入的推理與工具使用中斷對話。
讀原始報導

背景

即時語音 AI 著重讓使用者與模型流暢對話,並透過低延遲架構減少等待、提升自然度。市場上已有類似產品,例如 Google 發表的 Gemini Live,主打流暢對話,並與 OpenAI ChatGPT 的進階語音模式競爭。

來源

相關主題