Google 發布 Gemini 3.8 Live 與 Extended Thinking 語音模型:支援 97 語言與背景 API 呼叫,跑分擊敗 GPT-Live-1
新模型具備近即時視覺處理與邊想邊說能力,音訊輸入每分鐘僅 0.005 美元,已於 Gemini API 及 Workspace 上線,並內建 SynthID 浮水印。
Google DeepMind綜合 4 家一手來源
64 則值得知道的變化
新模型具備近即時視覺處理與邊想邊說能力,音訊輸入每分鐘僅 0.005 美元,已於 Gemini API 及 Workspace 上線,並內建 SynthID 浮水印。
報告建議企業日常任務預設使用開放權重模型,閉源前沿模型僅在專家級任務、高強度檢索與長文本處理,或需合規支援時才值得付費。
GPT-4.1 代理的五次全對率僅 53%。新工具透過重採樣決策點生成指南,在不犧牲準確率下將 24.4% 的一致性差距減半。