模型發布
愛詩科技發布實時世界模型 PixVerse R2,支援多模態控制與音畫同步,採雙層架構兼顧生成能力與實時性
量子位單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,愛詩科技近日上線全新實時世界模型 PixVerse R2,主打多模態控制與持續生成能力。R2 將文字、圖像、聲音、動作統一納入模型,具備邊生成邊響應與音畫同步能力。用戶可透過鍵盤控制方向,或輸入 Prompt 即時改變場景角色與劇情走向,適用於互動影遊與實時數位人等場景。
為解決模型能力與實時運算預算的衝突,R2 採用雙層架構。第一層「Omni Causal AR」負責提升能力上限,將多模態輸入統一進因果自迴歸框架,並透過動態 Chunk、Hybrid Teacher/Diffusion Forcing 與多時間尺度記憶等技術,解決長程生成中的誤差累積與角色漂移問題;第二層「Real-Time Acceleration」則將通用能力蒸餾進實時加速層以維持實時性。
報導指出,相較於 Google DeepMind Genie 2 需犧牲部分畫質換取實時性,R2 試圖透過分離能力與實時性的強化路徑來打破單幀運算預算的限制。愛詩科技曾於今年 1 月發布前代模型 R1。
讀原始報導