谷歌开源EmbeddingGemma 2嵌入模型,统一映射五类模态至768维空间
摘要
谷歌发布基于Gemma 4的开源嵌入模型EmbeddingGemma 2,采用Apache 2.0许可。该模型可将文本、代码、图像、视频和音频映射到统一的768维向量空间,参数量从270M到740M按需加载。
谷歌近日推出新一代开源嵌入模型EmbeddingGemma 2,该模型构建于Gemma 4基础之上,采用Apache 2.0许可协议对外发布。
与此前版本相比,EmbeddingGemma 2的核心变化在于将文本、代码、图像、视频和音频五类模态统一映射至768维向量空间,从而在单一表示框架下支持跨模态检索与匹配任务。
在参数配置上,该模型提供按需加载机制:面向文本和代码场景的版本参数量为270M,覆盖全模态的版本则为740M,用户可根据实际任务需求灵活选择。
作为开源模型,EmbeddingGemma 2的发布为多模态嵌入研究与应用提供了新的基础工具,其统一向量空间的设计思路或对跨模态检索系统的构建方式产生影响。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗