跳到正文
  1. Mistral AI

    Mistral 发布 Mistral Large 4 公开预览,1 万亿参数原生多模态

    Mistral 发布 Mistral Large 4 公开预览,这是一个 1 万亿参数、520 亿激活参数的原生多模态模型,权重将于本月底开放。官方称其在编码、智能体工作流和多模态理解上表现突出,在网络安全等企业任务上达到开放模型 SOTA,视觉定位等部分领域甚至超过前沿闭源模型。

    推荐理由:Mistral 迄今最大模型以开放权重和自部署切入网络安全等企业场景,可对照其与闭源模型的取舍。

  1. Google DeepMind

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与逐句表演指导,后者面向高并发、低成本的配音与语音智能体场景。

    推荐理由:两款 TTS 模型把语音生成从固定预设变成可逐句导演的创作流程,并给出基准排名与开放入口。

已经到底了