Google DeepMind 发布 740M 参数多模态嵌入模型 EmbeddingGemma 2
Bring multimodal semantic search to the edge with EmbeddingGemma 2
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
Google DeepMind 发布开放权重多模态嵌入模型 EmbeddingGemma 2,将文本、图像、视频帧和音频映射到统一向量空间,参数量 740M。文本权重约 191MB、完整多模态约 567MB 即可在 Pixel 11 Pro 上运行;无需微调即可做零样本意图路由,MacBook M5 Pro GPU 上视觉嵌入低至 37.3ms。
推荐理由
官方给出了参数量、内存占用和多设备延迟数据,并配套开源工具链,适合评估端侧多模态检索的落地路径。
来源:Google Developers Blog · developers.googleblog.com