Google 发布开源多模态嵌入模型 EmbeddingGemma 2
先了解这件事
2026 年 10 月 7 日,Google 发布开源模型 EmbeddingGemma 2。据 The Decoder 报道,该模型可将文本、图像、视频、音频和代码转换为数值向量,便于检索和比较相似内容;模型参数为 740M,Google 称其在多模态嵌入基准上超越规模最多两倍的竞品,在 Massive Text Embedding Benchmark (Code) 上得分 78.68,比前代 68.76 提升近 10 分。同日 Google DeepMind 发布一手消息,称 EmbeddingGemma 2 是面向端侧的多模态嵌入模型,原生将文本、图像、音频和视频映射到统一嵌入空间,基于 Gemma 4 架构,采用 Apache 2.0 许可,参数量 7.4 亿。两篇报道对模型能力描述基本一致,但 The Decoder 提到可处理代码,Google DeepMind 未提及代码。目前尚无后续进展。
AI 根据报道生成 · 40 分钟前更新
报道时间线
沿着报道,了解事件的不同侧面。
- Google DeepMind精选Google DeepMind 发布 EmbeddingGemma 2 开源轻量多模态嵌入模型
Google DeepMind 发布 EmbeddingGemma 2,这是面向端侧的多模态嵌入模型,原生将文本、图像、音频和视频映射到统一嵌入空间,基于 Gemma 4 架构,采用 Apache 2.0 许可,参数量 7.4 亿。
- The DecoderGoogle 发布 EmbeddingGemma 2,称性能超越两倍规模竞品
Google 发布开源模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,便于检索和比较相似内容。该模型参数为 740M,Google 称其在多模态嵌入基准上超越规模最多两倍的竞品,在 Massive Text Embedding Benchmark (Code) 上得分 78.68,比前代 68.76 提升近 10 分。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。