跳到正文
  1. Google Research

    Google Research 三个月实地实验:AI 辅助提升专利撰写产出,但初级律师无辅助判断力未同步提升

    Google Research 在 NBER 发布专利撰写三个月实地实验,将 Google Labs 未发布的 AI 专利写作助手(现属 Gemini Notebook)随机分配给 11 家律所的 133 名律师。

    推荐理由:三个月专利撰写实地实验区分了AI带来的即时产出提升与无辅助判断力的变化,为理解AI对专业能力的影响提供了少见的长期证据。

  1. Hugging Face Blog

    Nemotron 微调后在 IOI 2026 与 IMO 2026 均达金牌水平

    英伟达团队从 Nemotron 3 出发,用 SFT、RL 和反馈驱动的推理流程,让模型在 IOI 2026 和 IMO 2026 均达到金牌水平。

    推荐理由:原文公开了从 Nemotron 3 微调到 IOI、IMO 金牌级成绩的完整配方与数据集,可复用其训练与推理流程。

  1. OpenAI News

    OpenAI 公布 AI 数学研究结果与 Lean 证明资料

    OpenAI 公布内部前沿模型在数学开放问题上的一批研究结果,并在 GitHub 分享研究细节和部分证明的 Lean 形式化资料,供研究社区进一步检查与讨论。

    推荐理由:Danbo 编辑部核对官方原文整理

  2. OpenAI News

    OpenAI 与 Ironclad 探索复杂合同工作流中的电脑操作能力

    官方介绍双方如何在复杂合同工作流中训练和评估 AI Agent,研究面向专业工作的电脑操作能力。材料讨论的是训练与评估,不代表所有合同任务已经可以无人审核地执行。

    推荐理由:Danbo 编辑部核对官方原文整理

  1. Berkeley AI Research

    BAIR 介绍 K-Search:将 CUDA 内核优化经验迁移到 Apple Silicon

    伯克利 AI 研究博客讨论将 CUDA 生态中的内核优化经验转化为适合 MLX 和 Apple Silicon 架构的策略。文章强调需要按目标架构调整,而不是直接逐条复制指令。

    推荐理由:Danbo 编辑部核对官方原文整理

已经到底了