Microsoft Research 開源 Orchard,以同套基礎設施訓練與評估多類型 AI 代理
研究以三個能力不同的模型比較 Orchard Env 與直接使用 Docker,各組結果皆取三次獨立執行平均。
Microsoft Research一手來源
73 則值得知道的變化
研究以三個能力不同的模型比較 Orchard Env 與直接使用 Docker,各組結果皆取三次獨立執行平均。
Dreaming 封存 19.4% 至 23.5% 活躍記憶,問答準確率最高增加 10.3 個百分點。
研究涵蓋軍事原始碼、網路戰與社群監測;蒸餾模型可在通訊中斷時於無人機即時分析影像。
研究原型僅支援 Kotlin/JVM;24 項測試全數完成,編譯與類別重定義開銷約占總執行時間 1%。
論文於 4 月 30 日登上 arXiv;ReplicaOcc 零樣本測試中,RGB-D 版達 55.65 IoU/20.90 mIoU。
框架不更新模型參數,50 項未見任務皆有成功紀錄,主要測試平均成功率達 62%,並已公開論文與實作。
論文於 2026 年 6 月 2 日發布;原型不依賴供應商 API,並利用受感染 GPU 持續推理與擴散。
框架校正模型、時間與條件變化所致偏差,已用於社科調查、AutoRater 及 Agent Arena。
節目涵蓋快取感知路由、prefill/decode 分離、推測解碼,以及 Kimi 視覺編碼器移植。