Allen AI 發布開源 MoE 訓練框架 Olmo-core 3,支援兆級參數擴展,吞吐量較前代提升 2.7 倍
新版框架改採 DDP 架構並支援 MXFP8,在 512 張 B300 GPU 上成功實測 1.2 兆參數模型,大幅降低 MoE 路由與通訊成本。
HuggingFace Blog一手來源
58 則值得知道的變化
新版框架改採 DDP 架構並支援 MXFP8,在 512 張 B300 GPU 上成功實測 1.2 兆參數模型,大幅降低 MoE 路由與通訊成本。
AI 程式編輯器 Cursor 宣布正式上線 GLM 5.3 與 GLM 5.3 Flash,並指出 GLM 5.3 Max 是目前 CursorBench 4.0 評測基準中得分最高的開放權重模型。
新轉錄模型支援 60 種語言自動偵測,詞錯誤率僅 2.50%,並同步推出具備受限語音複製功能的 MAI-Voice-2.1。
該方法讓模型在失敗後寫下 TL;DR 洞察並進行反向傳播,僅需 4 千筆任務與洞察配對資料進行訓練,即可達到完整訓練效能。
Ataraxos 克服龐大隱藏資訊與單局高達兩千步的挑戰,以 15 勝 1 敗戰績,擊敗稱霸世界第一逾 600 週的人類玩家。
測試 8 款模型發現,當錯誤答案被包裝成檢索來源時,多數模型會放棄原先正確答案,僅 Gemini-3.1-Pro 幾乎不受影響。
具備檢索工具的 Agent loop 表現遠勝傳統 RAG。測試發現重排序模型反降準確率,且模型常以自身記憶作答並生成虛假引用。
這款人類互動模型在 NVIDIA 全雙工 AI 影片基準測試中奪冠,相較於其他系統僅約 3% 的欺騙率,其表現大幅領先。
透過 SSD 非同步預取技術減少延遲,實測在 13 萬 tokens 長上下文中,仍可維持 33 至 44 tok/s 的穩定解碼速度。