Google DeepMind·· 2026-06-09精选AI 评分67
Google DeepMind 发布 Gemma 4 12B:无编码器统一架构的多模态模型
Introducing Gemma 4 12B: a unified, encoder-free multimodal model
AI 导读
Google DeepMind 发布 Gemma 4 12B,采用无编码器统一架构,视觉与音频输入直接进入 LLM backbone,是该系列首个支持原生音频输入的中等规模模型。
推荐理由
官方说明新模型以无编码器统一架构把性能接近 26B 的多模态能力压到 16GB 内存笔记本可跑,开发者可据此评估端侧部署选择。
来源:Google DeepMind · deepmind.google