Cursor 開源 MoK 重寫 MoE GPU 核心,通訊延遲降至 18μs、GB300 訓練吞吐量提升 41%
MoK 針對 Blackwell 架構最佳化,將通訊與計算整合至單一 Megakernel,並將前向分發改為 Pull 模式,免除多方發送的位址協調。
54 則值得知道的變化
MoK 針對 Blackwell 架構最佳化,將通訊與計算整合至單一 Megakernel,並將前向分發改為 Pull 模式,免除多方發送的位址協調。
VR200 將於 2027 年接棒 GB300 成為出貨主力,因系統單價翻倍帶動產值飆升。同時 NVIDIA 藉千億美元殘值擔保跨足基礎設施,綁定算力需求。
系統以 Cloudflare Codex 為核心,將靜態文件轉為可機讀規則,涵蓋技術設計與事故報告,已揪出近 23 萬處不合規問題。
針對大規模部署挑戰,新版引入按需載入工具的 Tool Search、可視化版本控制介面,並支援單一代理依據角色權限自動調整服務邊界,降低管理複雜度。
新版底層透過 FastMCP 處理連線,支援多伺服器配置並自動加上命名空間防衝突,相容新舊 MCP 協定,並可透過 LangGraph 處理中斷提問。
該開源專案提供語意與模組化雙層 API,並支援透過 TVM FFI 整合自訂 GPU 核心,讓生產環境無需依賴 Python 即可執行。
該筆融資預計透過快速部署 GPU 產生營收償還。Lambda 本週亦完成 9.26 億美元貸款採購 GB300 系統,目前傳出正洽談 30 億美元 Pre-IPO 輪融資。
據報導,該設備採用 NVIDIA DGX Station 架構,支援串聯兩台主機擴充算力,並相容 NemoClaw 與 OpenShell 環境,協助企業在本地安全部署代理式 AI。
業者須揭露總能耗、IT 設備用電與尖峰用水量,若獲財務獎勵還需提供廢熱等永續指標,BPU 將發布匿名彙整數據。
儘管運行同等模型的成本急遽下降,效率提升與多步驟代理系統卻擴大了總需求,使價值集中於擴展較慢的實體資產。
此次更新主打為代理式 AI 時代打造,開源社群已迅速跟進,llama.cpp 的相關支援程式碼正等待審核中。