跳到主要內容
2026-09-09 日報
模型發布

基元律動發布 Agent-Native 模型 NeoHorse-1,基於執行軌跡後訓練,4B 版本五項基準超越 Qwen3.5-9B

AI 科技評論單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,由前華為諾亞方舟實驗室主任王雲鶴創辦的基元律動(TokenRhythm),聯合無問芯穹、清華大學等機構,推出首個 Agent-Native 模型 NeoHorse-1,包含 4B 與 9B 兩個版本。 NeoHorse 分別基於開源的 Qwen3.5-4B 和 Qwen3.5-9B 進行後訓練。訓練語料以 Routing Harness(含該公司開源系統 OpenSquilla)產生的 Agent 執行軌跡為核心,保留了能力需求預測、路由選擇、工具呼叫與環境回饋等資訊。團隊利用路由訊號安排訓練順序,並結合 Agent 執行監督與在策略蒸餾(On-Policy Distillation)更新模型,藉此探索遞迴自我改進(RSI)的單輪工程驗證。 在 11 項涵蓋 Agent 執行、工具互動與程式碼的基準評測中,NeoHorse 4B 在五項基準超過 Qwen3.5-9B 底座。報告指出,改善主要集中在流程清晰與回饋可觀察的任務,而更大模型在複雜狀態維護與失敗恢復上仍具優勢。
讀原始報導