Liquid AI 推出邊緣視覺語言模型 LFM2.5-VL-3B,強化螢幕理解與定位
該 3.1B 模型記憶體佔用低於 3.3GB,在蘋果 M5 Max 推論達 228 tokens/s,並大幅提升螢幕 UI 理解與函數呼叫能力。
HuggingFace Blog綜合 2 家一手來源
52 則值得知道的變化
該 3.1B 模型記憶體佔用低於 3.3GB,在蘋果 M5 Max 推論達 228 tokens/s,並大幅提升螢幕 UI 理解與函數呼叫能力。
模型以逾 10 萬小時、50 多種手語資料訓練,初期支援美國手語轉英語。系統僅擷取骨架座標進行翻譯,不回傳原始影片以保護隱私。
Runway 宣布最新影像模型 Grok Imagine Image 2.0 已正式加入其平台,使用者現可直接存取並體驗該模型。