模型發布
螞蟻靈波發布全棧大腦 2.0 推出 LingBot-VA 2.0 等 6 款模型,並啟動 15 億人民幣首輪融資
InfoQ 中國多家報導
尚未逐項核實
多個報導來源提及此事;未必是彼此獨立的證據。
螞蟻靈波於 WAIC 期間發布「全棧大腦 2.0」,一次推出 6 款模型,覆蓋空間智能、靈巧操作到環境回饋全鏈路,並宣布啟動首輪 15 億人民幣融資,計畫於年底完成第二輪。此次發布包含業界首個具身原生世界動作模型 LingBot-VA 2.0。首席科學家沈宇軍表示,目前機器人端到端控制尚未成熟,因此採取將感知、對齊、預測和行動等能力拆開驗證的策略,而非直接微調數位世界的影片模型。其中,影片生成模型 LingBot-Video 採用 MoE 架構以提升機器人推論速度,並在預訓練中加入大量機器人操作與移動資料,放棄數位世界模型關注的創造性與 ID 保持,專注於重力等物理規律的建模與合理性預判。在資料獲取上,螞蟻靈波現階段以真實資料為主,重點收集高品質的真機遙操作資料,以及易於擴展規模的第一人稱無本體資料,認為針對通用機器人構建全套模擬環境成本過高,且難以真實還原人類的下意識反應。
讀原始報導背景
具身智能領域的 VLA 模型研究近期高度活躍,每天都有大量相關論文發表,但實際可用的工程細節往往相當零散。此外,機器人在獲取空間位置資訊時,常需依賴 SLAM(同步定位與建圖)技術來協助其在物理世界中自主移動與環境感知。
來源
- AI 前線infoq.cn
- github.com
- ja.wikipedia.org