Google 在 Google I/O 上宣布推出 Gemini 3.5 模型系列,并以传闻属实作为开场。目前官方只公布了系列名称和 #GoogleIO 话题标签,未披露具体型号、参数或能力细节。
推荐理由:官方确认 Gemini 3.5 系列模型发布,读者可据此确认此前传闻并对照后续披露的型号与能力细节。
Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。
Google 在 Google I/O 上宣布推出 Gemini 3.5 模型系列,并以传闻属实作为开场。目前官方只公布了系列名称和 #GoogleIO 话题标签,未披露具体型号、参数或能力细节。
推荐理由:官方确认 Gemini 3.5 系列模型发布,读者可据此确认此前传闻并对照后续披露的型号与能力细节。
Google DeepMind 发布 Gemini 3.5 模型家族,首发型号为 3.5 Flash,官方称这是其目前面向智能体和编码能力最强的模型。该家族定位为结合前沿智能与现实世界行动。
推荐理由:Google DeepMind 公布 Gemini 3.5 家族,首发 3.5 Flash,读者可据此了解其在智能体与编码上的定位。
Google 的 Gemini Omni 支持用对话编辑视频,用户可在多轮提示中重新构想动作、改变视角或调整光线。每次指令都会基于上一条,让角色保持一致、物理表现成立,并让场景记住先前内容。
推荐理由:原文给出多轮对话编辑视频的交互方式,读者可以了解角色一致性和物理表现在连续指令下的处理。
Google 表示 Gemini App 用户数在一年内翻倍,已突破 9 亿。该推文带有 #GoogleIO 话题标签,未披露其他数据。
推荐理由:原文只给出 Gemini App 用户一年内翻倍并突破9亿这一数字,可据此观察其用户增长节奏。
Google DeepMind 发布 Gemini Omni 系列首个模型 Gemini Omni Flash,可将图像、音频、视频和文本组合为输入生成高质量视频。
推荐理由:官方宣布 Omni 家族首个模型,列明对话式改视频、物理理解、多输入融合等能力与各端开放范围,可据此评估对视频创作流程的影响。
Google 宣布扩展内容透明与验证工具,SynthID 验证今日在 Search 上线,未来数周进入 Chrome,Gemini 应用的验证功能已被使用 5000 万次。
推荐理由:原文给出 SynthID 验证入口、C2PA 支持范围和合作方名单,读者可以对照自己的使用场景判断这些工具的实际覆盖。
Stanford 医学院遗传学家 Gary Peltz 团队在 Advanced Science 发表研究,用 Co-Scientist 从现有药物文献中筛选可重定位治疗肝纤维化的药物。
推荐理由:原文给出 Co-Scientist 与人类专家选药的真实对比实验结果,读者可以据此了解 AI 辅助药物重定位的实际表现。
Google DeepMind 发布 Gemini 3.5 模型系列,首个模型 3.5 Flash 当天全球可用,定位为面向智能体工作流与编码的旗舰级速度模型。
推荐理由:官方公布了 3.5 Flash 的基准成绩、发布渠道和 3.5 Pro 时间表,读者可以据此评估其智能体与编码能力变化。
The Google Threat Intelligence Group has detected the first known instance of a threat actor using an AI-developed zero-day exploit in the wild. While the attackers planned a wide-scale strike, our proactive counter-discovery may have prevented that from happening. This finding is part of our new report on AI-powered threats.
推荐理由:Google 披露 AI 开发的零日漏洞已出现在野外攻击中,读者可据此看到攻击生成门槛与现有检测手段之间的落差。
Damn!所有AI开发者,立刻停下你手里的npm install🤯 现在正在爆发有史以来最恐怖的供应链攻击, 代号Mini Shai-Hulud, 已经波及TanStack全家桶、Mistral AI、UiPath等170多个npm和PyPI包, 全是你们天天装的工具链, 周下载量加起来超过一个亿, 已经不是传统的维护者账号被盗了, 而是整个GitHub Actions CI管道被直接劫持, 合法的官方项目,自己发布了带毒的版本, 还带完整的SLSA 3级可信证明, 所有传统的签名验证全失效, 最狠的是它的持久化机制, 它不会只藏在node_modules里, 它会直接修改你的~/.claude/settings.json和~/.vscode/tasks.json, 就算你npm uninstall删光所有包, 只要你下次打开Claude或者VS Code, 它就会自动重新执行, 如果你敢撤销被盗的token, 它会直接删光你整个home目录, 而且它是蠕虫, 偷到一个项目的CI密钥,就会自动感染下一个, 现在还在指数级扩散, 以前我们说别用latest,别用^, 现在就算你pin死了版本, 只要那个版本是6分钟窗口期内发布的, 就是带毒的, 越依赖AI Agent自动装包的人, 这次中招的概率越高, 因为你的Agent根本不会帮你检查lockfile, 现在立刻做这三件事, 第一,冻结所有包安装, 第二,跑npx supply-chain-attack全盘自查, 第三,全量旋转你所有的云密钥、GitHub token和SSH key, 一个都别漏。 #网络安全 #npm #AI开发者
推荐理由:这条汇总列出近期十余起安全漏洞与供应链投毒事件,可用于快速了解 AI 开发者工具链当前面临的风险面。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,介绍一个基于 Gemini 的多智能体 AI 系统,可迭代生成、辩论和演化科学假说,并通过新实验工具 Hypothesis Generation 向研究者开放,可在 labs.google/science 注册。
推荐理由:原文详述了多智能体系统的生成、辩论、演化机制和多所实验室的实际应用结果,读者可以据此判断它对科研工作流的可用性。
推荐理由:官方给出跨 Gmail、Photos、搜索与 YouTube 数据生成行程的能力,读者可借此判断个人数据整合的产品边界。
Introducing Pareto Code: a new, free, experimental coding router Set `min_coding_score` in your request and route to the cheapest code-capable model that clears your bar, ranked by @ArtificialAnlys. See the Pareto frontier shifting in real time👇
推荐理由:原文给出按编程分数门槛路由到最便宜模型的做法,读者可据此了解低成本编码模型的选型方式。
Google DeepMind 发布 AlphaEvolve 一周年成果汇总,介绍这款 Gemini 驱动的算法设计智能体在各领域的落地成果。
推荐理由:官方汇总了 AlphaEvolve 一年来在科研、基础设施和商业场景的具体成果与数字,读者可据此评估算法发现型 Agent 的落地范围。
Anthropic 宣布与 SpaceX 达成合作,将使用其 Colossus 1 数据中心的全部算力,本月内获得超过 300 兆瓦、逾 220,000 块 NVIDIA GPU 的新增容量。
推荐理由:Anthropic 列出了 SpaceX 及多家云厂商的算力来源,读者可据此理解其近期上调 Claude 用量上限的算力基础。
Sierra 团队推出 𝜏-voice 基准,将 𝜏-bench 的 278 个客服任务与全双工实时语音、可控真实音频结合,任务、工具和评估器与文本版逐字节一致,语音成绩可与文本 Agent 直接对比。
推荐理由:语音与文本能力可在同一套任务上直接对比,还给出了噪音与口音下各厂商的具体失败模式。
Google DeepMind 宣布 AI co-clinician 研究计划,探索在医生临床监督下以"三方诊疗"模式辅助患者。
推荐理由:官方给出评测细节与局限,专家医师在140项评估整体仍优于该系统,有助于客观看待医疗AI的进展与边界。
Google Cloud 在 Q1 2026 同比增长 63%,AWS 为 28%、Azure 为 40%,三家云厂商该季度基础设施资本开支合计 1120 亿美元。
推荐理由:文章对比三家云厂商的增速与资本开支,指出自有模型层与芯片的垂直整合是增长分化的重要原因。
Google 宣布在 Google Photos 的 Auto frame 功能中推出新的拍照后视角调整方法,通过 ML 模型理解场景空间布局并用生成式 AI 从新视角重构成像。
推荐理由:原文解释了两阶段 3D 场景重建加生成补全的技术路线,读者可以了解它与传统裁剪编辑的本质差别。
Anthropic 与 Amazon 签署新协议,将获得最高 5 吉瓦(GW)用于训练和部署 Claude 的算力,并在未来十年向 AWS 技术投入超过 1000 亿美元。
推荐理由:协议披露了算力规模、芯片代际与投资金额,可据此判断 Claude 训练与推理基础设施的扩张节奏。