跳到主要內容
2026-07-26 日報
模型發布

眸深智能獲近億元追加融資

36Kr據報導
據36Kr報導,眸深智能完成近億元Pre-A輪追加融資,投資方包括瑾悅投資、創合匯資本及既有股東徐匯資本等。該公司同時推出端側具身大模型STI-WM,採用網路影片、動作捕捉與真機資料混合訓練,宣稱可降低對真機資料的依賴。其技術路線聚焦動作Token、模型壓縮與國產晶片適配,但相關效能與成本數據目前主要來自公司說法。
讀原始報導

背景

VLA(Vision Language Action)是一種結合視覺、語言與動作能力的多模態機器學習模型,目標是將感知輸入直接映射為機器人控制動作,形成完整閉環。相關技術路線涵蓋離散動作 token,以及連續擴散與流匹配;眸深智能團隊則自 2022 年起發布 MLD(隱空間動作擴散模型),將擴散模型引入動作生成。

來源