跳到正文
  1. Hugging Face Blog

    Nemotron 微调后在 IOI 2026 与 IMO 2026 均达金牌水平

    英伟达团队从 Nemotron 3 出发,用 SFT、RL 和反馈驱动的推理流程,让模型在 IOI 2026 和 IMO 2026 均达到金牌水平。

    推荐理由:原文公开了从 Nemotron 3 微调到 IOI、IMO 金牌级成绩的完整配方与数据集,可复用其训练与推理流程。

  1. Mistral AI

    Mistral 发布 Mistral Large 4 公开预览,1 万亿参数原生多模态

    Mistral 发布 Mistral Large 4 公开预览,这是一个 1 万亿参数、520 亿激活参数的原生多模态模型,权重将于本月底开放。官方称其在编码、智能体工作流和多模态理解上表现突出,在网络安全等企业任务上达到开放模型 SOTA,视觉定位等部分领域甚至超过前沿闭源模型。

    推荐理由:Mistral 迄今最大模型以开放权重和自部署切入网络安全等企业场景,可对照其与闭源模型的取舍。

  2. OpenAI News

    OpenAI 公布 AI 数学研究结果与 Lean 证明资料

    OpenAI 公布内部前沿模型在数学开放问题上的一批研究结果,并在 GitHub 分享研究细节和部分证明的 Lean 形式化资料,供研究社区进一步检查与讨论。

    推荐理由:Danbo 编辑部核对官方原文整理

  1. OpenAI News

    OpenAI 发布 GPT-6 系列模型选择与开发指南

    官方指南面向应用开发者,介绍模型选择、推理强度、提示词与技能、工具协作,以及工作流进入生产环境前的准备。

    推荐理由:Danbo 编辑部核对官方原文整理

  1. NVIDIA Blog

    NVIDIA GPU 加速 OpenAI GPT-6 Astra Ultrafast 上线

    GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。

    推荐理由:原文给出 Ultrafast 相对标准模式的加速倍数与开放入口,读者可据此判断它对编码智能体循环的实际影响。

  1. Google DeepMind

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新一代前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步面向开发者、企业和消费者推出。

    推荐理由:Gemini 4 Argon 的发布信息包含输出上限、定价与多项基准成绩,可据此判断前沿模型在长程工程与安全场景的定位。

已经到底了