跳到正文
Google Developers Blog·· 19 小时前精选AI 评分70

Google DeepMind 发布 740M 参数多模态嵌入模型 EmbeddingGemma 2

Bring multimodal semantic search to the edge with EmbeddingGemma 2

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

Google DeepMind 发布开放权重多模态嵌入模型 EmbeddingGemma 2,将文本、图像、视频帧和音频映射到统一向量空间,参数量 740M。文本权重约 191MB、完整多模态约 567MB 即可在 Pixel 11 Pro 上运行;无需微调即可做零样本意图路由,MacBook M5 Pro GPU 上视觉嵌入低至 37.3ms。

推荐理由

官方给出了参数量、内存占用和多设备延迟数据,并配套开源工具链,适合评估端侧多模态检索的落地路径。

来源:Google Developers Blog · developers.googleblog.com