Google DeepMind 发布 Gemini Omni Flash,支持任意输入生成视频
Google DeepMind 发布 Gemini Omni 系列首个模型 Gemini Omni Flash,可将图像、音频、视频和文本组合为输入生成高质量视频。
推荐理由:官方宣布 Omni 家族首个模型,列明对话式改视频、物理理解、多输入融合等能力与各端开放范围,可据此评估对视频创作流程的影响。
deepmind.google · 网站与博客
Google DeepMind 发布 Gemini Omni 系列首个模型 Gemini Omni Flash,可将图像、音频、视频和文本组合为输入生成高质量视频。
推荐理由:官方宣布 Omni 家族首个模型,列明对话式改视频、物理理解、多输入融合等能力与各端开放范围,可据此评估对视频创作流程的影响。
Google DeepMind 推出 Gemini for Science,包含 Google Labs 上的三个原型工具:基于 Co-Scientist 的 Hypothesis Generation。
Google 宣布扩展内容透明与验证工具,SynthID 验证今日在 Search 上线,未来数周进入 Chrome,Gemini 应用的验证功能已被使用 5000 万次。
推荐理由:原文给出 SynthID 验证入口、C2PA 支持范围和合作方名单,读者可以对照自己的使用场景判断这些工具的实际覆盖。
Google DeepMind 在 National Partnerships for AI 计划下与新加坡政府展开国家级合作,聚焦医疗、教育、科研与可持续发展。
剑桥大学教授 Clare Bryant 用 Google Co-Scientist 研究流感跨物种传播,该工具生成并排序出一批候选假设,并优先标出一个她此前未关注的蛋白,将其与已有兴趣的信号通路关联。她随后在 Co-Scientist 内加入未发表数据,假设逐步收敛到具体氨基酸,团队正构建含该氨基酸突变的细胞系进行验证。Bryant 称,原本需两到三年的实验工作,如今有望在六个月内完成。
Google DeepMind 的 Co-Scientist 正被 Calico Life Sciences 用于整合衰老生物学中零散的研究发现并生成可验证假设。Calico 团队借助它针对整合应激反应(ISR)提出了一条关于代谢如何调控 ISR 的新假设,并据此优化实验设计、随结果迭代输入新信息,实验已产生对 ISR 在健康与疾病中作用有重要意义的新发现,团队计划发表这些结果。
爱丁堡大学团队用 Google Co-Scientist 研究 MASH 肝病,系统整合肝脏生物学与药理学证据,锁定值得关注的机制并筛选出候选组合疗法。针对 resmetirom 仅对少数合格患者有效的问题,Co-Scientist 提出 NLRP3 炎症小体是连接炎症与代谢的分子桥梁,该假说随后经实验验证,有望推动靶向双重疗法。
MIT 的 Ritu Raman 与波士顿儿童医院的 Ryan Flynn 借助 Google DeepMind 的 Co-Scientist,将组织工程与 RNA 表面图谱两套工具结合用于 ALS 研究。
Stanford 医学院遗传学家 Gary Peltz 团队在 Advanced Science 发表研究,用 Co-Scientist 从现有药物文献中筛选可重定位治疗肝纤维化的药物。
推荐理由:原文给出 Co-Scientist 与人类专家选药的真实对比实验结果,读者可以据此了解 AI 辅助药物重定位的实际表现。
Google DeepMind 发布 Gemini 3.5 模型系列,首个模型 3.5 Flash 当天全球可用,定位为面向智能体工作流与编码的旗舰级速度模型。
推荐理由:官方公布了 3.5 Flash 的基准成绩、发布渠道和 3.5 Pro 时间表,读者可以据此评估其智能体与编码能力变化。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,介绍一个基于 Gemini 的多智能体 AI 系统,可迭代生成、辩论和演化科学假说,并通过新实验工具 Hypothesis Generation 向研究者开放,可在 labs.google/science 注册。
推荐理由:原文详述了多智能体系统的生成、辩论、演化机制和多所实验室的实际应用结果,读者可以据此判断它对科研工作流的可用性。
Google DeepMind 发布 AlphaEvolve 一周年成果汇总,介绍这款 Gemini 驱动的算法设计智能体在各领域的落地成果。
推荐理由:官方汇总了 AlphaEvolve 一年来在科研、基础设施和商业场景的具体成果与数字,读者可据此评估算法发现型 Agent 的落地范围。
Google DeepMind 宣布 AI co-clinician 研究计划,探索在医生临床监督下以"三方诊疗"模式辅助患者。
推荐理由:官方给出评测细节与局限,专家医师在140项评估整体仍优于该系统,有助于客观看待医疗AI的进展与边界。
Google DeepMind 宣布与韩国科学技术信息通信部(MSIT)建立合作关系,正值 AlphaGo 首尔对局十周年。
Google DeepMind 发布 Decoupled DiLoCo(分布式低通信)训练架构,将训练拆分为异步的算力孤岛,硬件故障被隔离后其余部分可继续学习。
Google DeepMind 宣布与 Accenture、Bain & Company、BCG、Deloitte、McKinsey 合作,帮助全球企业规模化采用前沿 AI。合作方将获得包括 Gemini 系列在内的前沿模型早期访问权,并可直接对接 Google DeepMind 技术团队,聚焦金融、制造、零售、媒体娱乐等行业的智能体转型。目前仅 25% 的组织成功将 AI 规模化投入生产。
Google DeepMind 发布文本转语音模型 Gemini 3.1 Flash TTS,改进可控性、表现力和质量,在 Artificial Analysis TTS 排行榜获得 1,211 Elo 分。
推荐理由:官方介绍新增 audio tags 和多说话人对话能力,还给出 AI Studio 导演式控制与 API 导出的具体用法,便于开发者评估接入。
Google DeepMind 发布 Gemini Robotics-ER 1.6,提升机器人在空间推理、多视角理解、任务规划和成功检测方面的能力,并新增仪表读数功能。
推荐理由:官方给出了与上一代的具体能力对比和仪表读数新用例,读者可据此评估其是否适配现有机器人方案。