Ornith-1.5 開源模型發布:具備端到端自我改進框架,397B MoE 效能對標 Claude Opus 4.8
提供 397B、35B MoE 與 9B 尺寸,透過自動生成任務與強化學習實現自我改進;9B 量化版支援手機部署,397B 效能對標 Opus 4.8。
Hacker News綜合 2 家多家報導
63 則值得知道的變化
提供 397B、35B MoE 與 9B 尺寸,透過自動生成任務與強化學習實現自我改進;9B 量化版支援手機部署,397B 效能對標 Opus 4.8。
涵蓋 230M 至 2.6B 四款規模,新模型採用 QAD 技術維持低記憶體優勢,品質媲美 Q5_K_M 且解碼速度最高提升 33%。
該模型主打高保真度與精確文字渲染,在文字生成圖像榜單排名第七,目前已於 Microsoft Foundry 推出預覽版。
Agent Arena 新增 Pareto frontier 評測,對比模型在真實代理任務的效能與中位數成本。Claude Opus 5 (High) 效能最高,Kimi K3 (Max) 則以 0.62 美元成本展現極高性價比。
結合 Inco 發布的專用草稿模型,實測不僅生成速度翻倍,更在 RTX 3090 上將長對話後續輪次延遲從 23 秒降至 1 秒。
據實測,V100 透過自研核心即時轉換權重至 FP16,達成 219.1 tok/s 吞吐量,現已支援直接載入官方混合權重。