模型發布
生數科技發布 Vidu S2 模型:支援 720p 即時影片生成與編輯,可即時換裝、換背景與控制動作
愛範兒單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,生數科技發布 Vidu S2 模型,主打「邊看邊改」的即時影片生成與編輯能力,並將即時輸出解析度提升至 720p。
模型分為兩大模組:S2-Avatar 為即時互動模型,增強對舞蹈、手勢與微表情的理解,可透過語音或文字指令驅動動作,並能在直播中途插入參考圖讓數位人持物、換裝或切換背景;S2-Editing 為即時編輯模型,支援即時修改流動影片畫面的風格、服裝、人物主體與背景,適用於直播帶貨的無縫換裝或影視特效。
技術架構方面,Vidu S2 採用 Backbone-Refiner 兩階段架構,主幹網路負責骨架運動與物理規律的低延遲推流,精煉網路則在毫秒級內完成 720p 細節重構;臨時加入的參考圖由 VLM Agent 協調對齊特徵。此外,生數獨創 SRF(Self-Replay Forcing)訓練技術,讓模型具備自我糾錯記憶,以解決長時間生成的畫面漂移問題。
Vidu S2 支援將即時生成或編輯後的畫面轉換為同步的左右眼視圖,相容頭顯設備呈現立體深度。目前官方已開放體驗網址與 API 平台。
報導另引述彭博社消息指出,字節跳動也正準備推出允許用戶建立即時空間影片的 AI 模型,最快可能於下個月面世。
讀原始報導