模型發布
Google 推出 Gemini 3.8 Live Avatar,支援 97 語言即時嘴型同步,並同步發表 Extended Thinking 模型
TechNews 科技新報綜合 2 家報導多家報導
核實資料不足
多個報導來源提及此事;未必是彼此獨立的證據。
本次未取得足夠原文證據
Google 於 9 月 24 日宣布推出 Gemini 3.8 Live with Live Avatar,為對話式 AI 加入即時生成的虛擬人物形象。該功能讓 AI 代理人能透過臉部表情及嘴型與使用者互動,支援 97 種語言並能在不同語言間自然切換,維持影片畫質且無明顯影像飄移或嘴型錯位。在對話過程中,Avatar 能呼叫工具執行任務並直接顯示相關補充資訊。
目前 Live Avatar 僅於 Gemini Enterprise 提供,Google 提供預設 Avatar 圖庫,並開放企業建立專屬虛擬角色;輸出的內容會加入不可見的 SynthID 浮水印,以標示為 AI 生成並降低冒用風險。
此外,Google 同步推出 Gemini 3.8 Live Extended Thinking 模型,具備在不中斷對話的情況下執行背景任務的能力;其 Gemini 3.8 Audio 系列模型除了 Live 版本外,亦包含 Flash TTS 與 Flash-Lite TTS 等版本。
讀原始報導背景
Gemini 3.8 Live 是 Google 推出的語音互動模型,具備處理複雜推理、即時視覺上下文,以及在不中斷對話時執行背景任務的能力。此外,Google 透過 SynthID 技術為模型生成的內容添加浮水印,以協助識別 AI 生成的產物。
這則事件的發展
來源
- iThomeithome.com.tw
- blog.google
- deepmind.google