NVIDIA 開源 Nemotron 3 Ultra 數學推理系統,550B MoE 模型純自然語言獲 IMO 金牌 30 分
NVIDIA 釋出兩個專家模型權重、訓練資料與推理程式碼,該系統透過多輪改寫與驗證解題,但需 1.5TB 記憶體與龐大算力才能運行。
AI 科技評論單一來源
62 則值得知道的變化
NVIDIA 釋出兩個專家模型權重、訓練資料與推理程式碼,該系統透過多輪改寫與驗證解題,但需 1.5TB 記憶體與龐大算力才能運行。
該模型採用器官級細粒度對齊技術,內部測試 AUC 達 0.913,實測顯示能助醫生提升 10% 敏感度並減少逾 30% 閱片時間。
該系統基於 MiniCPM-o 4.5 改編,具備免訓練長影片記憶與非同步工具委派功能,能在共享時間線上同時處理視聽輸入並生成文字與語音。
新版模型在品質與速度邊界超越先前的 Lite 版,推薦配置佔用 13.1 GB VRAM,並支援 MTP 與 DFlash2 推測解碼以提升吞吐量。
系統將英文指令編譯為 LoRA,以 Qwen3 0.6B 為基礎推論;開發者可共用單一模型執行多個函式,其編譯器權重與 SDK 皆已公開。
據社群分享,該方案將 MoE 專家留在 SSD 並僅在需要時讀取,結合投機解碼與直接檔案讀取,大幅突破硬體記憶體限制。