前瞻與傳聞
據報 Google 推出 Gemini 3.8 Live 語音對話模型,支援 WebSocket 雙向串流與打斷功能
Simon Willison單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據開發者 Simon Willison 消息,Google 推出 Gemini 3.8 Live 與 3.8 Live Extended Thinking 兩款全新的端到端語音(speech-to-speech)模型,架構類似 OpenAI 的 GPT-Live 系列。實測顯示,開發者可直接連接 Google 的 WebSocket API 端點,並結合 Web Audio API 處理音訊擷取與播放。在無須第三方函式庫的環境下,即可在瀏覽器實作具備系統提示詞(system prompt)設定、語音預設選擇,以及支援隨時打斷模型說話的雙向語音對話介面。
讀原始報導