HyperAIHyperAI

Command Palette

Search for a command to run...

微调Nemotron模型获IOI与IMO金牌级成绩

近日,Nemotron团队宣布其基础模型家族在国际信息学奥林匹克竞赛(IOI 2026)与国际数学奥林匹克竞赛(IMO 2026)中均斩获金牌水平成绩,展现出卓越的领域自适应与复杂推理能力。团队以Nemotron-3为底座,通过监督微调与强化学习训练专项模型,并深度整合生成、验证与优化的测试时推理循环,成功攻克编程与数学两大高难度赛事。在IOI 2026实战中,Nemotron-3-Ultra-CC模型严格遵循限时与无网络规则,以535.4/600分超越官方金牌线及人类最高分;在IMO 2026中,多模型协同推理系统通过自然语言构建论证与自我审校,取得30/42分,同样突破金牌门槛。 该进展验证了一套清晰可复用的模型专业化路径:依托高质量领域语料与推理轨迹进行指令微调或强化学习,再结合高算力推理策略进行多轮候选生成与质量筛选。研究指出,模型专业化与测试时计算的协同设计是突破性能瓶颈的关键。目前,相关模型权重、训练数据、基准测试及完整推理流水线已全面开源至Hugging Face平台,为全球开发者构建顶尖垂直领域人工智能系统提供了标准化技术范式。

相关链接