跳到主要內容
2026-10-01 日報
模型發布

BAAI 推出 27B 代理模型 AREX-2:基於 Qwen3.8 架構,支援 256K 上下文與測試時自我改進

Reddit r/LocalLLaMA單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據開源社群消息,北京智源人工智慧研究院(BAAI)推出 27B 參數的長程代理模型 AREX-2。該模型為基於 Qwen3.8 架構的密集多模態模型,支援高達 262,144 tokens 的上下文長度。 AREX-2 的核心特徵在於測試時(test-time)的自我改進能力,能透過「提出、測量、反思、修改」的多輪迭代,讀取分數、日誌與錯誤訊息來持續優化解決方案。模型使用具備可驗證回饋的機器學習與演算法任務,結合既有的 AREX 深度研究資料進行訓練。這種跨領域訓練使其自我改進行為可直接遷移至深度研究任務,無需額外新增搜尋軌跡。目前社群已釋出 GGUF 量化版本供本地部署。
讀原始報導

這則事件的發展

  1. 2026-09-30智源 27B 多模態代理模型 AREX-2 上架 Hugging Face,MLE-Lite 評測達 81.8 分超越 GPT-5.6 Sol