模型發布
Google 推出 Gemini Omni 1.1 Flash,支援 40 秒影片擴展、首尾影格控制與 4K 升頻
Google DeepMind一手來源
尚未逐項核實
來源為發布方或研究資料;不代表所有主張已獲獨立核實。

Google DeepMind 宣布推出 Gemini Omni 1.1 Flash,全面升級生成式影片的控制能力,現已透過 Google AI Studio 的 Gemini API 開放使用。
新版本針對影片生成提供多項具體控制功能:
- **場景擴展**:模型現可分析高達 10 秒的前置上下文(前代僅參考最後 1 秒),允許開發者以每次 10 秒的增量延長現有影片,累計總長度最高可達 40 秒。
- **首尾影格指定**:支援設定影片的起始與結束影格,由模型生成中間的連續畫面,適用於複雜運鏡、縮放過渡或無縫循環片段。
- **360p 快速草稿**:提供 360p 解析度預覽,與標準 720p 相比,生成速度最高提升 60%,成本僅需三分之一。
- **4K 升頻與影片參考**:支援生成 1080p 或 4K 高解析度輸出;並允許在多模態輸入中加入最多 3 秒的參考影片,以維持角色與視覺上下文的一致性。
Omni 1.1 目前已透過 Agent Platform API 向企業開放,全球 Google AI Plus、Pro 與 Ultra 訂閱用戶也可在 Google Flow 中使用,其場景擴展功能已同步於 Gemini 應用程式上線。
讀原始報導背景
Google AI Studio 是一個網頁版整合開發環境,專供開發者與一般使用者測試與建立生成式 AI 應用。此次推出的 Gemini Omni 1.1 Flash 是一款生成式影片模型,透過 Gemini API 提供更強的控制功能,讓開發者能將其投入專業的影片製作工作流程中。