Nemotron 微调后在 IOI 2026 与 IMO 2026 均达金牌水平
英伟达团队从 Nemotron 3 出发,用 SFT、RL 和反馈驱动的推理流程,让模型在 IOI 2026 和 IMO 2026 均达到金牌水平。
推荐理由:原文公开了从 Nemotron 3 微调到 IOI、IMO 金牌级成绩的完整配方与数据集,可复用其训练与推理流程。
英伟达团队从 Nemotron 3 出发,用 SFT、RL 和反馈驱动的推理流程,让模型在 IOI 2026 和 IMO 2026 均达到金牌水平。
推荐理由:原文公开了从 Nemotron 3 微调到 IOI、IMO 金牌级成绩的完整配方与数据集,可复用其训练与推理流程。
Mistral 发布 Mistral Large 4 公开预览,这是一个 1 万亿参数、520 亿激活参数的原生多模态模型,权重将于本月底开放。官方称其在编码、智能体工作流和多模态理解上表现突出,在网络安全等企业任务上达到开放模型 SOTA,视觉定位等部分领域甚至超过前沿闭源模型。
推荐理由:Mistral 迄今最大模型以开放权重和自部署切入网络安全等企业场景,可对照其与闭源模型的取舍。
OpenAI 公布内部前沿模型在数学开放问题上的一批研究结果,并在 GitHub 分享研究细节和部分证明的 Lean 形式化资料,供研究社区进一步检查与讨论。
推荐理由:Danbo 编辑部核对官方原文整理
官方指南面向应用开发者,介绍模型选择、推理强度、提示词与技能、工具协作,以及工作流进入生产环境前的准备。
推荐理由:Danbo 编辑部核对官方原文整理
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。
推荐理由:原文给出 Ultrafast 相对标准模式的加速倍数与开放入口,读者可据此判断它对编码智能体循环的实际影响。
Google DeepMind 发布新一代前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步面向开发者、企业和消费者推出。
推荐理由:Gemini 4 Argon 的发布信息包含输出上限、定价与多项基准成绩,可据此判断前沿模型在长程工程与安全场景的定位。