跳到正文
  1. The Decoder

    OpenAI 发布 GPT-6,ChatGPT 输出改为图表、按钮与迷你应用的交互界面

    OpenAI 面向所有 ChatGPT 用户推出 GPT-6,并带来名为 Intelligent UI 的新功能,回答不再以纯文本呈现,而是根据问题自动生成图形、按钮、图表和表单等交互界面,比较类问题并排展示,解释类内容可转为交互图表,用户还能在对话内直接构建储蓄计算器或游戏等小工具。

    推荐理由:GPT-6 把 ChatGPT 输出从纯文本改为可交互界面,并给出分版本与分阶段开放安排,可据此判断使用方式的变化。

  2. Google Research

    Google Research 三个月实地实验:AI 辅助提升专利撰写产出,但初级律师无辅助判断力未同步提升

    Google Research 在 NBER 发布专利撰写三个月实地实验,将 Google Labs 未发布的 AI 专利写作助手(现属 Gemini Notebook)随机分配给 11 家律所的 133 名律师。

    推荐理由:三个月专利撰写实地实验区分了AI带来的即时产出提升与无辅助判断力的变化,为理解AI对专业能力的影响提供了少见的长期证据。

  1. Google DeepMind

    Google 为 Private AI Compute 引入服务端持久记忆

    Google 公布 Private AI Compute 平台新增私密服务端记忆能力,让 AI 助手在跨设备场景下保留上下文,同时维持端侧级别的隐私标准。该架构将数据封存在加密存储中,解密密钥仅保存在用户设备上,模型访问时通过端到端加密通道连接受信任执行环境,在隔离内存中临时解密并即时重新加密。

    推荐理由:Google 披露 Private AI Compute 如何把持久记忆放进云端安全隔离区,读者可了解隐私与云端算力如何兼顾。

  1. Google DeepMind

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与逐句表演指导,后者面向高并发、低成本的配音与语音智能体场景。

    推荐理由:两款 TTS 模型把语音生成从固定预设变成可逐句导演的创作流程,并给出基准排名与开放入口。

已经到底了