模型發布
NVIDIA Nemotron 3 於 IMO 與 IOI 2026 雙雙達到金牌水準,開源 Ultra-CC 模型與訓練資料集
HuggingFace Blog一手來源
核實資料不足
來源為發布方或研究資料;不代表所有主張已獲獨立核實。
本次未取得足夠原文證據

NVIDIA 團隊透過監督式微調(SFT)、強化學習(RL)與回饋驅動推論,使 Nemotron 3 模型在 IMO 2026(國際數學奧林匹亞)與 IOI 2026(國際資訊奧林匹亞)雙雙達到金牌水準。
在 IOI 2026 方面,團隊使用 5,500 億參數(活躍參數 550 億)的 Nemotron-3-Ultra-CC 模型,搭配 SFT 與 GenCorrect 策略,在與人類相同的時間與無網路限制下進行非官方實測,取得 535.4/600 分,超越金牌線(361.12)與人類最高分(498.27)。針對程式競賽,團隊策展了 2.2 萬道題目與合成推理軌跡進行訓練;另一款 300 億參數(活躍參數 30 億)的 Nemotron-3-Nano-CC 則同時接受了 SFT 與 RL 訓練。
在 IMO 2026 方面,團隊基於 Nemotron 3 Ultra 分別訓練了 SFT 與 RL 檢查點。SFT 語料包含 15,818 題共 414,890 筆涵蓋生成、驗證與改進的範例;RL 則使用 9,597 題。最終系統結合多個檢查點與「生成-驗證-改進」機制,全程僅使用自然語言,無依賴形式證明器或網路,取得 30/42 分(官方金牌線為 29),解答由官方評分員批改。
NVIDIA 已在 Hugging Face 發布 Nemotron-3-Ultra-CC 模型、IMO 2026 相關的 SFT 與 RL 檢查點、訓練資料集,以及包含 200 題的新基準測試 Nemotron-IMO-Bench。推論管線與提示詞則開源於 NeMo-Skills 儲存庫。
讀原始報導背景
Nemotron 是由 Nvidia 開發的人工智慧模型系列,涵蓋大型語言模型與多模態模型,專為推理、程式編寫及代理式 AI 等應用所設計。Nvidia 已針對該系列的部分模型開放了權重、訓練資料與相關軟體。