跳到正文
  1. Google Research

    Google Research 三个月实地实验:AI 辅助提升专利撰写产出,但初级律师无辅助判断力未同步提升

    Google Research 在 NBER 发布专利撰写三个月实地实验,将 Google Labs 未发布的 AI 专利写作助手(现属 Gemini Notebook)随机分配给 11 家律所的 133 名律师。

    推荐理由:三个月专利撰写实地实验区分了AI带来的即时产出提升与无辅助判断力的变化,为理解AI对专业能力的影响提供了少见的长期证据。

  1. Hugging Face Blog

    Nemotron 微调后在 IOI 2026 与 IMO 2026 均达金牌水平

    英伟达团队从 Nemotron 3 出发,用 SFT、RL 和反馈驱动的推理流程,让模型在 IOI 2026 和 IMO 2026 均达到金牌水平。

    推荐理由:原文公开了从 Nemotron 3 微调到 IOI、IMO 金牌级成绩的完整配方与数据集,可复用其训练与推理流程。

  1. Google

    Google Earth AI 联合全球卫生伙伴发布公共卫生预测研究

    Google Research 与全球卫生伙伴发布新研究论文,展示 Google Earth AI 如何结合环境信号、卫星影像、移动数据和 AlphaEarth Foundations、Population Dynamics Foundation Model(PDFM)等基础模型,并搭配地理空间推理智能体原型,帮助公共卫生团队预测疾病暴发。

    推荐理由:Google 与 WHO 等机构用 Earth AI 在刚果(金)埃博拉疫情中实测地理空间推理智能体,展示公共卫生预测从被动响应转向主动预防的路径。

  1. Google DeepMind

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质嵌入可验证水印

    Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,在数字模型和合成出的实体蛋白质上均可验证,同时保持其生物功能。

    推荐理由:DeepMind 把水印从数字内容延伸到合成生物,读者可了解其原理与生物安全筛查中的定位。

  1. 字节 Seed

    字节 Seed 发布 EdgeBench 评测集,发现环境学习新 Scaling Law

    字节 Seed 发布用于衡量真实世界环境学习的超长程评测集 EdgeBench,包含 134 个真实任务,横跨六大能力领域,Agent 在每个任务上可持续工作至少 12 小时。

    推荐理由:字节 Seed 开源 EdgeBench 并给出环境学习曲线,读者可了解 Agent 长程学习如何被量化。

已经到底了