研究與評測
Microsoft Research 開源 Orchard,以同套基礎設施訓練與評估多類型 AI 代理
Microsoft Research一手來源
尚未逐項核實
來源為發布方或研究資料;不代表所有主張已獲獨立核實。
Microsoft Research 發布開源框架 Orchard,供研究社群跨任務類型訓練與評估 AI 代理。Orchard 讓研究者重用同一套基礎設施,以降低研究複雜度,並支援較小模型取得良好表現。研究使用 3 個能力不同的模型,比較 Orchard Env 與直接使用 Docker;每種模型與後端組合的結果,均取自 3 次獨立執行的平均值。
讀原始報導背景
Orchard 的公開資料集收錄軟體工程任務的代理軌跡,並與論文〈Orchard: An Open-Source Agentic Modeling Framework〉一同發布。相關研究也在 Terminal-Bench 2.0 上比較 Orchard Env 與直接使用 Docker 的基準方法。