谷歌DeepMind开源EmbeddingGemma 2:740M参数多模态嵌入模型,量化后191MB内存即可运行

作者:Google DeepMind / AIBriefs 发布时间:2026-10-08 18:45:01
关键字:
Google DeepMind发布基于Gemma 4的740M参数多模态嵌入模型EmbeddingGemma 2,将文本、代码、图像、视频和音频统一映射到768维向量空间,采用Apache 2.0许可,量化后在手机上仅需约191MB运行内存。

统一多模态向量空间

Google DeepMind发布开源嵌入模型EmbeddingGemma 2。该模型基于Gemma 4构建,拥有740M参数,可将文本、代码、图像、视频和音频统一映射到同一个768维向量空间,实现跨模态检索与语义搜索。

手机端可运行

EmbeddingGemma 2支持弹性裁剪:纯文本场景可缩减至270M参数运行。经过量化后,模型在Pixel 11 Pro上仅需约191MB活跃内存即可运行,为端侧AI搜索、相册检索和离线语义匹配提供了轻量级方案。

Apache 2.0完全开放

模型采用Apache 2.0许可发布,允许商业使用与二次分发。开发者可在Hugging Face获取权重,结合Sentence Transformers等框架快速接入现有检索管线。

嵌入模型的战略价值

随着RAG(检索增强生成)和智能体记忆系统普及,高质量嵌入模型成为基础设施的重要一环。谷歌以开放许可巩固嵌入生态,与OpenAI的商业嵌入API形成差异化路线,也为端侧AI应用补上了关键拼图。

本文由AI融业云采集并编辑,仅供学习使用!

本文来自网络,作者Google DeepMind / AIBriefs

关于AI融业云:一站式AI应用服务平台,了解创始人 | 联系我们

有问题,请联系客服!http://www.rongyeyun.com/kefu/