跳到正文
热点事件观察中

Google发布EmbeddingGemma 2多模态嵌入模型

4 篇报道4 个报道来源2 天前更新

先了解这件事

AI 综述

Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可将文本、图像、音频、视频和代码映射到统一嵌入空间。模型权重已在 Hugging Face 和 Kaggle 提供,可本地运行、无需 API 密钥;纯文本任务可用 270M 参数版本,视觉和音频编码器分别为 170M 和 300M。 Google 称该模型是同类型中最紧凑的,在多模态嵌入基准上超过参数量两倍的竞品,在 Massive Text Embedding Benchmark (Code) 上得分 78.68,高于前代的 68.76。据 Google 数据,量化后在 Pixel 11 Pro 上,纯文本权重占用约 191MB 内存,完整多模态模型约 567MB。 Simon Willison 认为嵌入模型不应采用闭源、专有、仅托管的形式,因为用户需存储大量嵌入向量,厂商停用模型后重新计算成本高昂;他倾向付费使用托管版本,同时保留自行运行开放权重的退路。

AI 根据报道生成 · 3 小时前更新

事件进展

2 个进展

  1. 10月7日 04:37 · 1 篇报道
    EmbeddingGemma 2 采用 Apache 2.0 许可证
    Simon Willison:EmbeddingGemma 2 采用 Apache 2.0 许可证
  2. 10月7日 00:00 · 3 篇报道
    Google发布EmbeddingGemma 2嵌入模型
    Google:Google 发布 EmbeddingGemma 2 开源多模态嵌入模型

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. Simon Willison
    EmbeddingGemma 2 采用 Apache 2.0 许可证

    EmbeddingGemma 2 采用 Apache 2.0 许可证,Simon Willison 认为嵌入模型不应使用闭源、专有、仅托管的形式。他指出嵌入模型通常需要计算并存储数千甚至数百万条嵌入向量,一旦厂商停用模型,用户就得为重新计算这些向量付费。他更愿意付费使用托管版本,同时保留厂商停服后自行运行开放权重或另寻供应商的退路。

  2. Google DeepMind精选
    Google DeepMind 发布 EmbeddingGemma 2 多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可将文本、图像、音频和视频映射到统一嵌入空间。

  3. The Decoder
    Google 发布 EmbeddingGemma 2 多模态嵌入模型

    Google 发布开源多模态嵌入模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为向量。该模型参数为 7.4 亿,Google 称其是同类型中最紧凑的模型,在多模态嵌入基准上超过参数量两倍的竞品;在 Massive Text Embedding Benchmark (Code) 上得分为 78.68,比前代 68.76 提升近 10 分。

  4. Google精选
    Google 发布 EmbeddingGemma 2 开源多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、Apache 2.0 许可的 740M 参数多模态嵌入模型,可将文本、图像、音频和视频映射到统一嵌入空间。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。