2026年10月7日,谷歌正式推出EmbeddingGemma 2,将文本嵌入能力扩展至代码、图像、视频和音频,统一映射至同一嵌入空间。该模型基于Gemma 4架构,参数量7.4亿,采用Apache 2.0许可。其模块化设计支持按需加载文本(2.7亿参数)、视觉(1.7亿)或音频(3亿)编码器;借助Matryoshka技术,向量维度可动态压缩,存储开销最高降低6倍;量化后在Pixel 11 Pro上纯文本仅需191MB内存,完整多模态模型约567MB。支持8K上下文,适用于离线跨模态搜索与RAG应用。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。



