基元律動發布 Agent-Native 模型 NeoHorse,4B 版本綜合表現媲美 9B 基礎模型
該模型由前華為盤古負責人王云鶴團隊研發,結合多模型執行軌跡與路由引導課程學習進行後訓練,專案已於 GitHub 與 Hugging Face 上架。
79 則值得知道的變化
該模型由前華為盤古負責人王云鶴團隊研發,結合多模型執行軌跡與路由引導課程學習進行後訓練,專案已於 GitHub 與 Hugging Face 上架。
該模型具備 8K 上下文窗口,在 ParseBench 測試中以 79.2 分超越 Gemini 3 Flash,並同步開源基礎模型 North-Micro-Vision-Instruct 權重供本地部署與微調。
阿里宣布 Wan 3.0 正式上線,主打文字生成動畫功能,使用者僅需輸入簡單的提示詞,即可產出具備電影級畫質的動畫內容。
AI 程式碼編輯器 Cursor 官方宣布,由 Meta 開發的 Muse Spark 1.3 模型現已正式上線,供開發者於編輯器內直接使用。
該模型基於 Qwen3.5 底座,以 Routing Harness 產生的 Agent 執行軌跡為核心語料進行後訓練,作為遞迴自我改進(RSI)的單輪工程驗證。
該模型保留預訓練 VLM 架構,透過外部 BEV 感知頭與規劃專家模組,在單一框架內實現 3D 物件偵測與自車軌跡生成。
官方稱其品質對標 GPT-5.6 Luna 等輕量模型,具備可調推理與平行工具呼叫能力,並同步預覽語音與路由專用模型。
Reddit LocalLLaMA 社群傳出 nex-agi 釋出名為 Nex-N2.5-mini 的 35B 參數模型,目前尚未有進一步的規格與效能數據。
面壁智能推出主打通用 Agent 任務的 2B 規模端側模型。除了模型本身,本次也一併開放了相關訓練資料、強化學習(RL)框架與訓練方法。
該中間版本採用新架構,目前定價與 V4 Flash 相同,每個帳號限制 20 個並行請求,需將模型名稱設為特定字串即可呼叫。
相較 Google 與 Meta 轉向 Apache 2.0,Kimi K3 等中國模型新增商業限制;同期 Qwen 釋出 125B 預覽版。
模型採稀疏 MoE 架構,每次 token 僅啟動 5.5B 參數以提升推論效率,並結合 VideoRoPE 技術編碼時空順序,支援長影片問答與事件定位。
據社群論壇消息指出,一款名為 Muse 的個人 AI 代理曝光,主打能為使用者代辦各項任務,其底層由 Muse Spark 1.3 模型驅動。
根據推特用戶 Leo 透露,Fable 計畫在九月底至十月初之間推出全新的預訓練模型,目前官方尚未正式證實此消息。