跳到正文
  1. Microsoft Research

    微软开源 Agent Lightning v1.0:3500 行轻量级 Agentic RL 框架

    微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量级 Agentic RL 框架,提出 Harnessed Agentic RL 训练范式,让部署时使用的 agent harness 直接参与强化学习,无需在训练框架内重新实现 agent。

    推荐理由:Agent Lightning v1.0 用约 3500 行代码实现完整 agent RL 控制面,并给出 SWE-bench Verified 上的训练增益数据。

  2. Google Research

    Google Research 三个月实地实验:AI 辅助提升专利撰写产出,但初级律师无辅助判断力未同步提升

    Google Research 在 NBER 发布专利撰写三个月实地实验,将 Google Labs 未发布的 AI 专利写作助手(现属 Gemini Notebook)随机分配给 11 家律所的 133 名律师。

    推荐理由:三个月专利撰写实地实验区分了AI带来的即时产出提升与无辅助判断力的变化,为理解AI对专业能力的影响提供了少见的长期证据。

  1. Hugging Face Blog

    Nemotron 微调后在 IOI 2026 与 IMO 2026 均达金牌水平

    英伟达团队从 Nemotron 3 出发,用 SFT、RL 和反馈驱动的推理流程,让模型在 IOI 2026 和 IMO 2026 均达到金牌水平。

    推荐理由:原文公开了从 Nemotron 3 微调到 IOI、IMO 金牌级成绩的完整配方与数据集,可复用其训练与推理流程。

  1. Google

    Google Earth AI 联合全球卫生伙伴发布公共卫生预测研究

    Google Research 与全球卫生伙伴发布新研究论文,展示 Google Earth AI 如何结合环境信号、卫星影像、移动数据和 AlphaEarth Foundations、Population Dynamics Foundation Model(PDFM)等基础模型,并搭配地理空间推理智能体原型,帮助公共卫生团队预测疾病暴发。

    推荐理由:Google 与 WHO 等机构用 Earth AI 在刚果(金)埃博拉疫情中实测地理空间推理智能体,展示公共卫生预测从被动响应转向主动预防的路径。

  1. Hugging Face Blog

    Ai2 开源 AstaBrief 8B 科学报告生成模型

    Ai2 开源 AstaBrief 8B,一个把研究问题和检索到的文献片段转成带引用报告的模型,已作为 Asta 的 Fast 模式上线,并同步开放权重和训练数据。

    推荐理由:原文公开了 AstaBrief 的训练数据构造与引用过滤细节,可供做科学报告生成的团队参考。

  1. Google DeepMind

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质嵌入可验证水印

    Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,在数字模型和合成出的实体蛋白质上均可验证,同时保持其生物功能。

    推荐理由:DeepMind 把水印从数字内容延伸到合成生物,读者可了解其原理与生物安全筛查中的定位。

  1. 字节 Seed

    字节 Seed 发布 EdgeBench 评测集,发现环境学习新 Scaling Law

    字节 Seed 发布用于衡量真实世界环境学习的超长程评测集 EdgeBench,包含 134 个真实任务,横跨六大能力领域,Agent 在每个任务上可持续工作至少 12 小时。

    推荐理由:字节 Seed 开源 EdgeBench 并给出环境学习曲线,读者可了解 Agent 长程学习如何被量化。

已经到底了