跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

当前仅显示精选新闻

最新精选

第 161–180 条 · 共 258 条
6月4日周四
  1. @berryxia73

    Google 昨晚发布 Gemma 4 12B 多模态模型,采用 Apache 2.0 许可,至少需要 16G 内存即可运行。该模型为统一的无编码器多模态模型,主打把高性能智能直接带到笔记本上,衔接端侧效率与高级推理。作者认为应与 Qwen 的模型对比其效果。

    引用Google Gemma (@googlegemma)@googlegemma

    Meet Gemma 4 12B! A unified, encoder-free multimodal model designed to bring high-performance intelligence directly to your laptop, and released under an Apache 2.0 license. Bridging the gap between edge efficiency and advanced reasoning. Here is what’s new with Gemma 4 12B: 👇

    推荐理由:Gemma 4 12B 采用 Apache 2.0 许可并主打端侧多模态,可据此判断 16G 内存本地运行的可行性。

  2. AI寒武纪 · 微信公众号80

    谷歌DeepMind开源Gemma 4 12B,16GB内存笔记本可本地跑多模态

    谷歌DeepMind发布并开源Gemma 4 12B,这是一个统一、无编码器的多模态模型,只需16GB显存或统一内存即可在消费级笔记本上运行。它在标准评测基准上的成绩接近26B MoE模型,总内存占用不到后者一半,采用Apache 2.0协议,预训练与指令微调权重可从Hugging Face和Kaggle下载。

    推荐理由:原文介绍了无编码器多模态架构如何降低延迟和内存占用,并列出16GB笔记本可用的本地运行入口。

  3. @kimmonismus81

    Google 发布 Gemma 4 12B 开源模型,采用 Apache 2.0 许可,可在 16GB 显存笔记本上本地运行,支持智能体推理、视觉与音频,作者称其质量接近 Google 的 26B 模型。

    引用Google (@Google)@Google

    Today we’re introducing Gemma 4 12B — our latest open model that brings advanced agentic reasoning, vision and audio directly to your laptop. It delivers performance nearing our larger Gemma models with a much smaller total memory footprint, while being small enough to run locally with just 16GB of VRAM. It’s open and accessible for everyone to use under a permissive Apache 2.0 license. This is all made possible by our new, unified architecture that removes separate multimodal encoders. Here’s how we did it 🧵

    推荐理由:它把视觉与音频编码器并入主干,让 12B 模型能在 16GB 显存本地运行,读者可据此判断端侧多模态的门槛变化。

  4. @AYi_AInotes73

    Google 发布 Gemma 4 12B,一款基于 Apache 2.0 许可的免编码器统一多模态模型,把传统 ViT 视觉编码器的 150M-550M 参数压到 35M 轻量嵌入器。

    引用Google Gemma (@googlegemma)@googlegemma

    Meet Gemma 4 12B! A unified, encoder-free multimodal model designed to bring high-performance intelligence directly to your laptop, and released under an Apache 2.0 license. Bridging the gap between edge efficiency and advanced reasoning. Here is what’s new with Gemma 4 12B: 👇

    推荐理由:借 Gemma 4 12B 取消视觉编码器的设计,讨论统一多模态模型可能如何替代现有拼装式流水线。

  5. @googleaidevs75

    Google 发布 Gemma 4 12B,一款不含多模态编码器的统一模型,可直接在笔记本上运行。该模型定位在移动端 E4B 与更大的 26B MoE 模型之间,视觉和音频输入直接进入 LLM 主干,原生支持音频,采用 Apache 2.0 许可。官方称在 16GB VRAM 下可本地运行复杂多步工作流,性能接近 26B 模型。

    推荐理由:官方给出无编码器架构与 16GB VRAM 本地运行的定位,读者可据此判断端侧多模态模型的选型边界。

6月3日周三
  1. AI前线 · 微信公众号83

    Alphabet 启动 800 亿美元股权融资,加码 AI 基础设施

    Alphabet 当地时间 6 月 1 日公布总额 800 亿美元的股权融资计划,资金用于 AI 底层基础设施与全球算力集群扩建。融资由 300 亿美元公开发行、400 亿美元 ATM 持续增发计划和向伯克希尔·哈撒韦定向配售 100 亿美元三部分组成,后者的 A 类普通股较 Alphabet 收盘价 376 美元约有 6% 折扣。

    推荐理由:账面现金超千亿仍启动800亿美元增发,可作为观察AI基建投入如何改变科技巨头财务结构的样本。

  2. @berryxia65

    Google DeepMind 发布基于 Gemini 的多 Agent 系统 Co-Scientist,可生成、辩论并演化复杂科学问题的新假设。该系统覆盖从 idea 到验证的循环,能生成上千个假设、举办 idea 锦标赛,并让多个 Agent 互相批判精炼,再用文献、数据和搜索工具验证主张。

    引用Google DeepMind (@GoogleDeepMind)@GoogleDeepMind

    We believe AI can be a dedicated research partner to help discover the next breakthrough. Enter Co-Scientist: our latest Gemini-based multi-agent system that can generate, debate and evolve novel hypotheses for complex scientific problems 🧵 Video

    推荐理由:原文说明了 Co-Scientist 的多 Agent 假设生成与验证流程,并指出该能力已向个人研究者开放。

6月2日周二
  1. IT Home76

    Alphabet 宣布 800 亿美元大额融资,用于 AI 基础设施与算力建设

    Alphabet 宣布进行共计 800 亿美元的股权融资,所得将用于投资 AI 基础设施与算力等目的。其中通过包销公开发行筹集 300 亿美元,按市值发行 400 亿美元的 A 类或 C 类股票,伯克希尔·哈撒韦则以私募形式直接投资 100 亿美元。

    推荐理由:800 亿美元融资与 Alphabet 2026 年 1800~1900 亿美元资本支出计划并列,读者可以看到算力投入的资金节奏。

  2. @berryxia67

    Gemini Omni 上线数字头像功能,用户在 Gemini App 或网页的设置菜单点 Avatar,拍几张照片并录几句语音即可生成外貌与声音都像本人的数字分身。生成后在工具栏选中该 Avatar,就能把自己放进视频,普通用户几分钟可完成。所有用 Gemini Omni 生成的视频都会自动嵌入不可见 SynthID 数字水印,可在 Gemini App 中验证其是否为 AI 生成。

    引用Google Gemini (@GeminiApp)@GeminiApp

    Easily add yourself to your video creations in Gemini. Here’s how to create your own digital avatar that looks and sounds like you with Gemini Omni. 🧵

    推荐理由:原文给出三步生成数字分身并嵌入视频的流程,并说明 SynthID 水印可用于验证 AI 生成来源。

5月30日周六
5月29日周五
5月28日周四
5月27日周三