研究 #开源模型 2026-10-09 · 原文发布 10-07

NVIDIA 微调 Nemotron 拿下 IOI 2026 535.4/600、IMO 2026 30/42 金牌线成绩,并开放权重与训练数据

同一个开放模型家族在编程和数学竞赛上都过了金牌线,配套的数据和评测流程也一起放出。

一手来源 NVIDIA · Hugging Face 博客 · huggingface.co 读原文 ↗

// 要点

  • IOI 2026:Nemotron-3-Ultra-CC(550B 总参、55B 激活)加 SFT 与 GenCorrect 得 535.4/600,金牌线 361.12,人类最高 498.27;非官方参赛、不计入正式排名。
  • IMO 2026:基于 Nemotron 3 Ultra 的系统得 30/42,高于金牌线 29 分,证明由官方 IMO 评分员评分。
  • 放出 Ultra-CC 的 NVFP4 权重、IMO 的 SFT 与 RL 检查点、两套训练数据(含 2.2 万道编程题),以及 200 题的 Nemotron-IMO-Bench;推理与评测流程在 NeMo-Skills 仓库。
  • 文中未写明许可证。

开发者视角550B 的模型多数团队用不上,真正值得拿走的是方法:Nano(30B 总参、3B 激活)在 IOI 2025 上从 SFT 后的 280 分靠 GenCorrect 这类测试时策略提到 468 分。做代码类产品的,可以先在自家评测集上试「生成后再自我纠错」这一层。

// 来龙去脉 · 来自 #开源模型 专题

看完整时间线 →
  1. 10-09 LightOn 开源 LightOnOCR-3:0.8B 到 4B 三个尺寸,Apache 2.0,olmOCR-Bench 最高 86.3
  2. 10-09 Liquid AI 开放 d1 决策模型:d1-3B 一次前向给出判断,RTX 4090 上单题 8 毫秒
  3. 10-07 Mistral Large 4 公开预览:1T 总参数、49B 激活,API 每百万 token 输入 1.36 美元,权重月底开放