Embedding Gemma 2
谷歌开源的轻量级多模态嵌入模型,支持在手机端离线运行,能够检索文本、图片、视频和音频,面向隐私敏感的端侧语义搜索场景
Core Facts
Timeline (last 90 days)
Embedding Gemma 2拥有7.4亿参数,由270M文本、170M视觉与300M音频编码器组成,运行时动态内存约191MB至567MB,270M版本最低0.5GB内存运行,完整多模态版1GB内存可本地运行
Google DeepMind发布了Embedding Gemma 2,一个开放的多模态嵌入模型,参数量740M,将文字、图片、视频和音频映射到同一向量空间
Embedding Gemma 2输出768维向量(可截短到512、256或128维),上下文长度8192 Token,支持100多种语言,采用Apache 2.0许可
谷歌开源Embedding Gemma 2,支持手机端离线检索文本、图片、视频和音频,在Pixel 11 Pro测试中多模态检索约占567MB内存
Google发布Embedding Gemma 2,是其首个面向端侧的原生多模态开放嵌入模型,仅7.4亿参数,采用Apache 2.0许可证开放权重,可在同一共享空间理解文本、代码、图像、音频和视频
Embedding Gemma 2在NVIDIA DGX Spark本地测试中为300张动物照片建索引,200次检索命中165次,精度达82.5%
All Facts (6)
Google发布Embedding Gemma 2,是其首个面向端侧的原生多模态开放嵌入模型,仅7.4亿参数,采用Apache 2.0许可证开放权重,可在同一共享空间理解文本、代码、图像、音频和视频
75%UnverifiedGoogle DeepMind发布了Embedding Gemma 2,一个开放的多模态嵌入模型,参数量740M,将文字、图片、视频和音频映射到同一向量空间
60%UnverifiedEmbedding Gemma 2拥有7.4亿参数,由270M文本、170M视觉与300M音频编码器组成,运行时动态内存约191MB至567MB,270M版本最低0.5GB内存运行,完整多模态版1GB内存可本地运行
50%UnverifiedEmbedding Gemma 2输出768维向量(可截短到512、256或128维),上下文长度8192 Token,支持100多种语言,采用Apache 2.0许可
50%UnverifiedEmbedding Gemma 2在NVIDIA DGX Spark本地测试中为300张动物照片建索引,200次检索命中165次,精度达82.5%
50%Unverified谷歌开源Embedding Gemma 2,支持手机端离线检索文本、图片、视频和音频,在Pixel 11 Pro测试中多模态检索约占567MB内存
50%