NVIDIA Nemotron 团队公布 IOI 2026 与 IMO 2026 双金牌级别微调结果
NVIDIA 在 Hugging Face 博客公布,基于 Nemotron 3 微调的系统在 IOI 2026 与 IMO 2026 上同时达到金牌级别。
推荐理由:展示了同一基座在算法竞赛与数学奥赛两条赛道上达到金牌水平所用的微调与推理组合策略,并公开了数据集与复现入口。
NVIDIA 在 Hugging Face 博客公布,基于 Nemotron 3 微调的系统在 IOI 2026 与 IMO 2026 上同时达到金牌级别。
推荐理由:展示了同一基座在算法竞赛与数学奥赛两条赛道上达到金牌水平所用的微调与推理组合策略,并公开了数据集与复现入口。
OpenAI 发布内部 frontier model 在数学开放问题上的最新结果,并在 GitHub 分享 Lean 证明形式化与研究细节。材料未提供具体问题、模型名称或结果数据。
Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发及沙特与中东地区 AI 解决方案部署,合作规模达数亿欧元。双方将推进先进模型的本地化,初期聚焦网络安全和语音领域,并开发在阿拉伯语上表现强劲的前沿模型;Mistral 将探索使用 HUMAIN 的数据中心基础设施以满足本地算力需求,双方还将制定面向金融、制造、电信等重点监管行业的联合市场策略。
自适应并行推理(Adaptive Parallel Reasoning)让大语言模型自行决定何时拆分、并行推理子任务,被视为突破顺序推理扩展瓶颈的新范式。传统并行方法如 Self-consistency、Best-of-N、MCTS 等需外部预先设定并行结构,而新近的 ParaThinker、GroupThink 和 Hogwild!