跳到主要內容
2026-08-06 日報
開發生態

Cursor 開源 B200 專用 MoE 訓練 megakernel,宣稱端到端加速達 40%

Reddit r/LocalLLaMA單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據 Reddit 社群消息指出,Cursor 針對 B200 晶片開源了一款用於 MoE(混合專家)訓練的 megakernel。官方宣稱該核心可帶來約 40% 的端到端(e2e)加速,前向傳遞(forwards)速度則提升約 140%。該專案目前以 Apache 2.0 授權免費開放。不過,社群開發者對官方跑分持保留態度,認為與一般開發者編寫的基礎核心相比,實際的端到端加速可能落在 10% 至 20% 之間,建議使用者應自行進行實測。
讀原始報導

背景

混合專家模型(MoE)能在顯著減少運算資源的情況下進行預訓練,讓開發者能在與密集(dense)模型相同的運算預算下,大幅擴展模型或資料集的規模。

來源

本期分類
相關主題