跳到正文
原文
Google DeepMind·· 2026-06-09精选AI 评分67

Google DeepMind 发布 Gemma 4 12B:无编码器统一架构的多模态模型

Introducing Gemma 4 12B: a unified, encoder-free multimodal model

AI 导读

Google DeepMind 发布 Gemma 4 12B,采用无编码器统一架构,视觉与音频输入直接进入 LLM backbone,是该系列首个支持原生音频输入的中等规模模型。

推荐理由

官方说明新模型以无编码器统一架构把性能接近 26B 的多模态能力压到 16GB 内存笔记本可跑,开发者可据此评估端侧部署选择。

来源:Google DeepMind · deepmind.google