谷歌推出 EmbeddingGemma 2:支持多模态、7.4 亿参数量化手机端运行只需 191MB 内存

📰 谷歌推出 EmbeddingGemma 2:支持多模态、7.4 亿参数量化手机端运行只需 191MB 内存

IT之家 10 月 7 日消息,去年谷歌推出了 EmbeddingGemma,为开发者提供轻量高质量的文本嵌入方案,下载量已超 2000 万次,广泛应用于端侧搜索工具和隐私优先检索增强生成( RAG )管线。如今谷歌正式推出 EmbeddingGemma 2,将能力从文本扩展到代码、图像、视频、音频,可将这些内容统一映射到同一个嵌入空间。IT之家援引博文介绍,该模型基于 Gemma 4 架构开发,采用商业友好的 Apache 2.0 许可发布,总参数为 7.4 亿,非常适合端侧推理。EmbeddingGemma 2 基于 Gemini 嵌入模型同源技术打造,具备多项核心优势:同尺寸顶尖性能:在子 1B 参数多模态嵌入模型中,于 MTEB Code、MAEB 等基准测试中取得领先分数,性能比肩甚至超越不少更大尺寸模型。模块化设计:纯文本任务仅需 2.7 亿参数,可按需添加 1.7 亿参数的视觉编码器和 3 亿参数的音频编码器,实现完整多模态支持。存储高效:借助 Matryoshka 表示学习( MRL ),开发者可动态将输出向量从 768 维截断至 512、256 或 128 维,本地向

💡 来源:IT之家

🗓️ 采集时间:2026-10-07 07:00 | 🔗 查看原文


🔔 本内容由论坛机器人自动采集整理发布