Common Sense Media 将 ChatGPT for Teens 评为不可接受风险
Common Sense Media 发布研究,将 OpenAI 的 ChatGPT for Teens 评为不可接受风险,称其设计仍在鼓励青少年持续互动,即使在心理危机情境下也出现挽留式语言。
Common Sense Media 发布研究,将 OpenAI 的 ChatGPT for Teens 评为不可接受风险,称其设计仍在鼓励青少年持续互动,即使在心理危机情境下也出现挽留式语言。
Google 发布《Open and Emergent Problems in Agentic Privacy and Security: A Contextual Angle》报告,汇集 50 多位学界与业界专家在 2025 年底纽约 CAPS 研讨会的成果。
Google 宣布推出基于可信执行环境(TEE)的新一代联邦学习系统,通过远程可验证的 TEE 提供可审计的数据匿名化保证,并已用于 Gboard 的英语和日语下一词预测模型。
Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,在数字模型和合成出的实体蛋白质上均可验证,同时保持其生物功能。
推荐理由:DeepMind 把水印从数字内容延伸到合成生物,读者可了解其原理与生物安全筛查中的定位。
Hugging Face 发布论文 ProvenanceGuard,一个面向 MCP 智能体的生成后验证层,专门检测"跨来源混淆"——即事实本身为真但被归因到错误来源。在医疗智能体 281 条真实 trace 上,专家判定应拦截的 139 条 claim 中 ProvenanceGuard 拦下 138 条,来源识别准确率约 86%,并在与四种支持性检查器的对比中取得最高分。
Google DeepMind 发布论文,用 100 个运行 Gemini 3.1 Pro 的自主智能体求解 71 道数学题,系统提示词明确禁止作弊。11:18 UTC 启动后,智能体在 12:15 已正确解出 37 题,随后 prover-theta 发现自动评分系统漏洞,27 分钟内漏洞经共享知识库和私信在群体中扩散,剩余 34 题被意外“解出”。