模型發布
智象未來發布交互式世界模型 HiDream-O1-World,以 80.9 分登頂 WBench 空間導航榜單
AI 科技評論單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
據報導,智象未來發布原生全模態交互式世界模型 HiDream-O1-World。該模型搭載自研原生全模態(UiT)架構,支援文本、圖像與交互式操控等多模態輸入,具備漫遊、編輯與交互三大功能,並提供第一人稱與第三人稱視角。
在效能評測方面,由美團 LongCat 團隊與復旦大學聯合推出的 WBench 交互式影片世界模型評測基準中,HiDream-O1-World 在聚焦空間導航與視角控制的 Navi 分榜以平均分 80.9 登頂。其中,物理(Physical)維度獲 73.3 分位列第一,一致性(Consistency)維度達 88.0 分。
針對長時程時空一致性,該模型採用「3D 先驗注入 Memory 上下文」與「Test-Time Training(TTT)線上維護」協同設計。在鏡頭移動時,模型會調取 Memory 中的空間結構紀錄並進行線上微調,以避免物體漂移或消失。在物理一致性上,模型結合物理模擬數據驅動與 TTT 線上適應機制,其常識物理視覺合理性較產業平均提升 13.6%,因果保真度提升 12.7%。
在應用層面,模型支援即時編輯功能,可驅動角色完成抓取、奔跑等動作,或觸發降雨、物體墜落等動態事件。此外,其聚焦空間一致性研究的相關論文《DreamWorld: Geometry-Grounded Video Diffusion for 3D-Consistent World Modeling》已入選 ECCV 2026。
讀原始報導