Hugging Face 介绍 Nemotron 微调后在 IOI 2026 和 IMO 2026 达到金牌水平
Hugging Face 介绍 Nemotron 团队从 Nemotron 3 出发,通过 SFT、RL 和反馈驱动推理,在 IOI 2026 与 IMO 2026 达到金牌水平。
推荐理由:文章同时给出训练数据、推理流程和开源入口,可参考其将基础模型专门化到竞赛任务的方法。
Hugging Face 介绍 Nemotron 团队从 Nemotron 3 出发,通过 SFT、RL 和反馈驱动推理,在 IOI 2026 与 IMO 2026 达到金牌水平。
推荐理由:文章同时给出训练数据、推理流程和开源入口,可参考其将基础模型专门化到竞赛任务的方法。
Microsoft Research 访谈 Jennifer Neville,讨论评估如何推动 AI 系统性能边界,并揭示传统 benchmark 之外的“意外失败”。Neville 研究交互式领域与结构化数据中的机器学习和 AI,已发表 130 多篇论文、获 10,000 多次引用,并分享当前 AI 系统使用建议。
OpenAI 公布了一个内部前沿模型在数学开放问题上的新结果。OpenAI 还在 GitHub 分享了 Lean 证明形式化内容和研究细节。
Google DeepMind 宣布 Gemini 4 Argon,这一前沿模型将先通过 Fairwind Program 向一组受信任的网络防御者推出,并逐步扩大访问。
推荐理由:原文给出发布节奏、价格和多项基准结果,可用于了解 Google 对高能力模型分阶段开放的安排。
Google DeepMind 推出 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,用于近实时推理、语音智能体和更自然的 AI 对话。
推荐理由:原文同时给出语音模型能力、评测结果和开放入口,便于判断其在语音智能体中的适用场景。
BAIR 庆祝 2026 届 Ph.D. 毕业生,他们的研究覆盖机器人与具身智能、LLM 与推理、计算机视觉、生成建模、AI 安全、人机交互、AI for science and healthcare 等领域。毕业生将前往高校任教或从事博士后研究、加入产业研究实验室,或创办自己的初创公司。
Berkeley AI Research 文章分析 Adaptive Parallel Reasoning,认为它让模型在推理时自行决定何时拆解任务、启动多少并行线程以及如何协调。
Berkeley AI Research 介绍 GRASP,一种用于学习动态系统“世界模型”的梯度式规划器,旨在让长时域规划更实用。GRASP 将轨迹提升为虚拟状态以并行优化时间维度,在状态迭代中直接加入随机性用于探索,并重塑梯度,让动作获得更清晰信号,同时避免穿过高维视觉模型的脆弱“state-input”梯度。