Google发布开源多模态嵌入模型EmbeddingGemma 2
先了解这件事
2026年10月7日,Google发布开源多模态嵌入模型EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,参数量为7.4亿。Google称该模型在多模态嵌入基准上超过参数量最多两倍的竞品,并在Massive Text Embedding Benchmark (Code)上得分78.68,较前代68.76提升近10分。同日,Google DeepMind发布一手信息称,EmbeddingGemma 2基于Gemma 4架构、采用Apache 2.0许可,把文本、图像、音频和视频映射到统一嵌入空间,参数量740M。随后,Simon Willison就EmbeddingGemma 2采用Apache 2.0许可证发表看法,认为嵌入模型不应使用闭源、专有、仅托管的形式:嵌入模型应用通常需计算并存储数千甚至数百万条嵌入向量,一旦厂商停供专有模型,用户就得为重新计算这些向量付费;他表示更愿意付费使用托管版本,同时保留厂商停服后可自行运行开放权重版本或另寻供应商的余地。
AI 根据报道生成 · 41 分钟前更新
报道时间线
沿着报道,了解事件的不同侧面。
- Simon WillisonEmbeddingGemma 2 采用 Apache 2.0 许可证
EmbeddingGemma 2 采用 Apache 2.0 许可证,Simon Willison 认为嵌入模型不应使用闭源、专有、仅托管的形式。嵌入模型应用通常需计算并存储数千甚至数百万条嵌入向量,一旦厂商停供专有模型,用户就得为重新计算这些向量付费。他更愿意付费使用托管版本,同时保留厂商停服后可自行运行开放权重版本或另寻供应商的余地。
- Google DeepMind精选Google DeepMind 发布 EmbeddingGemma 2 开源多模态嵌入模型
Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、Apache 2.0 许可的开源多模态嵌入模型,把文本、图像、音频和视频映射到统一嵌入空间,参数量 740M。
- The DecoderGoogle 发布 EmbeddingGemma 2 多模态嵌入模型
Google 发布开源多模态嵌入模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,参数量 7.4 亿。Google 称其在多模态嵌入基准上超过参数量最多两倍的竞品,在 Massive Text Embedding Benchmark (Code) 上得分 78.68,比前代 68.76 提升近 10 分。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。