跳到主要內容
2026-09-24 日報
模型發布

FLUX 3 Action 7B 開源發布:登頂 RoboLab 基準,參數少 56% 且速度快 3.95 倍

Reddit r/singularity單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據 Reddit 社群消息指出,7B 參數的開源世界動作模型(World Action Model)FLUX 3 Action 已發布。該模型在 RoboLab 基準測試中取得第一,相較於先前最佳的開源模型,效能提升 6.1 個百分點,同時參數減少 56%、運行速度提升高達 3.95 倍。 FLUX 3 Action 克服了過去世界動作模型效能與 VLA(視覺語言動作模型)速度之間的權衡限制。它能同時預測影片與動作,規劃未來的距離是過去最強開源 VLA 的兩倍以上,且在每秒機器人動作的執行速度上更快。 該模型基於 FLUX 3 的圖像、影片與音訊預訓練基礎,採用適合實際部署的較小架構,並在訓練中期加入動作與未來影格的聯合預測。使用者可透過自有資料微調 FLUX 3 Action,以建立特定機器人與任務的控制策略;此外,該模型在遊戲、車輛控制與電腦操作等需要理解視覺環境並進行決策的模擬環境中,也展現出訓練特定任務策略的潛力。相關模型權重已於 Hugging Face 開放。
讀原始報導