模型發布
NVIDIA揭Vera Rubin後訓練策略
NVIDIA Blog
NVIDIA 公布 Vera Rubin 面向代理式 AI 持續後訓練的硬體與軟體策略,主打提升 intelligence per dollar,並搭配 NeMo RL 等開放函式庫。NVIDIA 表示,Vera Rubin 訓練最大規模模型所需的 GPU 僅為 Blackwell 世代的四分之一;550B 開放權重 MoE 模型 Nemotron 3 Ultra 在 SWE-bench Verified 取得 71.7%。相關效能數據與部署案例目前均由 NVIDIA 單一來源提供。
讀原始報導背景
Rubin 是 NVIDIA 公開的次世代 GPU 架構,將接替 Blackwell,預計於 2026 年問世;Vera Rubin 平台整合 Vera CPU、Rubin GPU、ConnectX-9 SuperNIC、BlueField-4 DPU、NVLink 6 交換器及 Spectrum-6 乙太網路交換器。後訓練涵蓋強化學習、偏好最佳化、領域調適、代理式訓練與評估,而強化學習正逐漸成為針對企業特定領域工作流程客製化語言模型與代理程式的實用途徑。