谷歌推出 EmbeddingGemma 2:支持多模态,量化后手机运行仅需 191MB 内存
谷歌发布 EmbeddingGemma 2,可将文本、代码、图像、视频和音频映射到同一嵌入空间。该模型基于 Gemma 4 架构,参数量为 7.4 亿,采用 Apache 2.0 许可。其模块化设计和 Matryoshka 表示学习支持按需调整模型组件与向量维度。谷歌称,量化后的纯文本版本在 Pixel 11 Pro 上约需 191MB 内存,完整多模态版本约需 567MB。模型支持 8K Token 上下文,可用于端侧多模态搜索和 RAG。谷歌还表示,其代码嵌入基准测试成绩显著提升。模型权重已在 Hugging Face 和 Kaggle 上提供。
本文来源:IT之家,仅供学习参考,版权归原作者所有。