開發生態
OpenAI六個月重建語音架構,GPT-Live可邊說邊聽
OpenAI News綜合 2 家報導一手來源
尚未逐項核實
來源為發布方或研究資料;不代表所有主張已獲獨立核實。
OpenAI在六個月內打造GPT-Live,採用無需輪流發言的語音模型與低延遲架構,讓使用者能與AI持續進行更快速、自然的語音互動。為使系統能在ChatGPT規模下自然運作,OpenAI從用戶端到模型重建整套語音技術堆疊,使音訊可連續流動,GPT-Live也能在說話時同步聆聽,避免較深入的推理與工具使用中斷對話。
讀原始報導背景
即時語音 AI 著重讓使用者與模型流暢對話,並透過低延遲架構減少等待、提升自然度。市場上已有類似產品,例如 Google 發表的 Gemini Live,主打流暢對話,並與 OpenAI ChatGPT 的進階語音模式競爭。
來源
- X @OpenAInitter.net
- ithome.com.tw