Reflection 發表 501B 開放權重 MoE 模型 Beam,主打推論效率並推動企業 AI 工廠
Beam 活躍參數 23B,經 10.5K 張 GB300 強化學習訓練,官方稱其代理效能逼近 Qwen 3.8-Max,推論運算量較同級少 3 倍,預計本月釋出權重。
Hacker News綜合 2 家多家報導
47 則值得知道的變化
Beam 活躍參數 23B,經 10.5K 張 GB300 強化學習訓練,官方稱其代理效能逼近 Qwen 3.8-Max,推論運算量較同級少 3 倍,預計本月釋出權重。
該模型採 Apache-2.0 授權並支援 262K 上下文,結合線性與稀疏注意力機制大幅降低記憶體消耗,數學與程式跑分微幅領先 Qwen3.8-27B。