HuggingFace 發布 Agent 記憶體研究:強模型需完整指南,弱模型適合檢索,DeepSeek-V3.2 任務完成率提升 9.5%
研究以 ALTK-Evolve 提取過往軌跡作推論指南,免更新權重。gpt-oss-120b 採精簡檢索策略,任務完成率提升 16.1%。
HuggingFace Blog一手來源
60 則值得知道的變化
研究以 ALTK-Evolve 提取過往軌跡作推論指南,免更新權重。gpt-oss-120b 採精簡檢索策略,任務完成率提升 16.1%。
Claude 針對 15 個目標成功設計 14 個蛋白質結合劑,部分親和力超越已知最佳結果並獲外部實驗室驗證;官方預告將推出科學家專屬計畫。
該模擬器強調動作可控性,拒絕為錯誤策略自動糾錯畫面,並支援操作員遙控接管與狀態回滾,藉此生成新軌跡用於策略後訓練。
代理雖能完成文獻回顧與實驗等工程任務,但缺乏判斷力且無法修正錯誤方向;研究團隊現已改用受管制的 Anthropic Mythos 模型進行後續測試。
系統結合 DingoFS 與 DFKV 分布式快取技術,將在線投機者學習轉為異步強化學習並支援權重熱插拔,實現零停機時間。
本屆大會主賽道共接收 713 篇論文,並首創早期職業焦點演講。卓越研究獎與約翰·麥卡錫獎分別由 Nicholas R. Jennings 及 David C. Parkes 獲得。