谷歌推出多模态嵌入模型 EmbeddingGemma 2,端侧运行内存低至 191MB
昨天
谷歌推出 EmbeddingGemma 2,基于 Gemma 4 架构开发,采用 Apache 2.0 许可发布,总参数 7.4 亿,基于 Gemini 嵌入模型同源技术打造,可将文本、代码、图像、视频、音频统一映射到同一嵌入空间。该模型在子 1B 参数多模态嵌入模型中性能领先,采用模块化设计,支持动态截断输出向量维度,端侧运行内存占用低,配备 8K Token 上下文窗口,代码性能较前代大幅提升,多模态任务表现优异,可保障数据隐私、降低管线延迟,支持搭建完全离线的跨模态搜索和检索系统,搭配同源的 Gemma 4 等生成模型可实现低内存占用的端侧多模态 RAG 管线,支持多平台多类常用开发工具,开发者可在 Hugging Face 和 Kaggle 下载模型权重,后续还将登陆 Gemini Enterprise Agent Platform Model Garden。
体验专业版特色功能,拓展更丰富、更全面的相关内容。