清華與無問芯穹開源具身智能基礎設施 RPent,整合 GPT-6 Astra 於 LIBERO-Pro 成功率達 92.6%
該框架結合大模型規劃與 VLA 專家模型,透過記憶機制與任務卡沉澱經驗,將端到端任務執行提速 7 倍,並支援多種真實機器人與模擬環境。
量子位綜合 2 家單一來源
58 則值得知道的變化
該框架結合大模型規劃與 VLA 專家模型,透過記憶機制與任務卡沉澱經驗,將端到端任務執行提速 7 倍,並支援多種真實機器人與模擬環境。
採用更大基礎模型與更長強化學習訓練,官方稱性價比與安全性領先,但獨立評測顯示其代理編碼能力遠不及前沿競品。
該系列主打擴展強化學習算力與 100 萬上下文,支援 3D 空間推理,其中 Flash-RL 版本已上架 Hugging Face。
評測由 UC Berkeley 推出,考驗真實資料環境分析能力。方案代號 Scout,未來將整合至 OceanBase DataPilot。
據實測,未壓縮的 8-bit 模型因投機解碼接受率較高,平均生成速度反超壓縮版本,且混合架構支援高達 256k 脈絡長度。