跳到主要內容
2026-08-12 日報
模型發布

LTX 發布開放權重影片生成模型 LTX-2.5:原生整合 ComfyUI,雙 GB200 生成 10 秒影片僅需 6.8 秒

VentureBeat單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

LTX 發布開放權重影片與世界模型 LTX-2.5,並與 ComfyUI 達成合作實現原生整合。模型權重已上架 Hugging Face,年營收低於 1000 萬美元的組織可免費使用,大型企業需另行協商授權,並同步推出託管的 LTX API。 LTX-2.5 重構了生成管線,導入新的擴散影片解碼器以減少高動態畫面的偽影;支援原生多鏡頭生成,可單次輸出完整序列並保持跨鏡頭的角色與場景一致性;採用自訂 Gemma 4 語言骨幹處理複雜提示詞;並提供專為物理 AI 與機器人微調的預訓練權重。此外,其蒸餾模型經與 NVIDIA 最佳化,降低了記憶體需求,可於 RTX GPU 本地運行。 官方宣稱其成本與渲染時間分別為競品的 1/8 與 1/7。據報導,在兩張 GB200 晶片上生成 10 秒影片僅需 6.8 秒,確實約為最快競品 API(Gemini Omni Flash,52 秒)的 1/7。但在成本方面,LTX-2.5 API Fast 方案為每秒 0.09 美元(10 秒 0.90 美元),約為 Veo 3.1(4.00 美元)的 1/4、FLUX 3 Video(1.70 美元)的一半,且略貴於 Veo 3.1 Lite(0.50 美元),並未達到宣稱的 1/8 成本絕對優勢。
讀原始報導

背景

ComfyUI 是一款開源且基於節點的生成式介面,常結合 Stable Diffusion 等擴散模型與 ControlNet 等工具進行創作。而「開放權重」(open weights)則是指公開 AI 模型訓練後的參數,讓開發者能自由下載與使用該模型。

來源