Google Research 提出 Retrieve-for-Train:用 RL 编译扩散模型绕过推理瓶颈
Google Research 提出 Retrieve-for-Train 框架,通过离线强化学习发现奖励对齐的查询扇出并编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现单次非自回归的查询扇出,无需推理时的 CoT 思考 token。该方法基于 Gemma3-4B 和 Qwen3-4B 微调,旨在解决零样本 LLM 在数据库感知查询分解中的复述坍缩与自回归延迟瓶颈。
Google Research 提出 Retrieve-for-Train 框架,通过离线强化学习发现奖励对齐的查询扇出并编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现单次非自回归的查询扇出,无需推理时的 CoT 思考 token。该方法基于 Gemma3-4B 和 Qwen3-4B 微调,旨在解决零样本 LLM 在数据库感知查询分解中的复述坍缩与自回归延迟瓶颈。
Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两个实时语音对话模型,主打近实时推理与语音智能体。
推荐理由:官方给出两个新语音模型的定位分工和多项基准数字,读者可据此判断其适合规模化还是高复杂度语音任务。
Google 宣布其技术现已支持超 300 种语言,覆盖 70 亿人、占全球人口 86%,并同步发布 AI & Economy ATLAS 交互洞察。同期科学进展包括开放 AlphaGenome Atlas 全基因组 90 亿个单字母变异预测,推出全球天气模型 WeatherNext 3,其提前一天以上降水预报准确率提升 50%。
Google 宣布其语言技术已覆盖 300 多种语言、服务超 70 亿人,占全球人口 86%。Gemini 3.5 Live Translate 支持 70 种语言。
推荐理由:官方梳理了从实时翻译到无障碍设计的语言 AI 布局,并给出各产品的覆盖语言数和合作项目,可作了解现状的参考。
Google 正与全球社区和研究者合作,把 AI 用于疾病检测、治疗与预防、自然灾害预测、教育普及和经济机会拓展等社会影响领域。该内容集合展示了专家与地方领导者如何借助 AI 突破,让更多人共享 AI 带来的机会。
Google 发布 AI & Economy ATLAS 新数据可视化开放入口,并联合 Google DeepMind 和 MIT FutureTech 发表基于 ATLAS 数据的新研究,分析 2600 个专用 AI 模型并调研 600 多位美英科学家。
Google Developers Blog 发布零信任 Agent 系列第二篇,将安全检查从构建时移到 Gemini Enterprise Agent Platform 的运行时。
NASA 宇航员 Christina Koch 与 Google 研究高级副总裁 James Manyika 在 Dialogues on Technology and Society 最新一期节目中对话。Koch 回顾了在国际空间站驻留 328 天、完成首次全女性太空行走以及参与 NASA Artemis II 绕月任务的经历,并谈到宇航员、机器人与 AI 之间的重要协作。
Google DevFest 2026 于 10 月 1 日至 12 月 31 日回归,由全球 Google Developer Groups 在 115 个国家举办 800 多场活动,预计近百万开发者参与。
inclusionAI 发布 SingProbe,一个基于 google/gemma-4-26B-A4B-it 的流式安全探针,复用基座模型隐藏状态逐 token 打分,仅增加不到 0.5% 解码开销。
inclusionAI 推出 SingProbe,一个基于 google/gemma-4-E4B-it 的流式安全探针,复用基座模型隐藏状态,在生成每个 token 时对查询意图、回复安全性和幻觉风险打分,解码开销低于 0.5%。
inclusionAI 发布 SingProbe,一个基于 google/gemma-4-31B-it 的流式护栏探针,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
Google 推出 autofinetune,将自主研究循环用于 LLM 后训练,基于 Tunix、Gemma 和 Cloud TPU,由 Antigravity CLI 与 Gemini Flash 3.7 编排。
Google Research 提出 ToolGrad,一种“答案优先”的工具调用数据集生成范式:先生成真实工具调用链,再反向标注用户提示词,只需一步 LLM 调用。
Google Search 的 AI 功能可帮跑者备战比赛:AI Mode 配合 Canvas 工具生成个性化训练计划,连接 YouTube Music 账号后还能定制跑步歌单。选购装备时,Search 依托超过 600 亿条商品信息的 Shopping Graph 提供推荐、库存对比和本地可用性。
Google DeepMind 与 Primordial Soup 合作制作纪录短片《Love, Rendered》,用 AI 重建 Burt 和 Ethelle Shatz 结婚 70 多年来未被拍摄记录的初遇记忆。
Google Search 推出橄榄球赛季新功能,包括实时比赛动态 Live Game Feed、更详细的球员与联盟数据统计,以及关联梦幻橄榄球账号获取个性化建议。Live Game Feed 已在美国移动端上线英文版,本月底将支持大学球队并扩展至更多地区;梦幻账号关联功能目前也仅限美国英文用户。
OpenRouter 发布美国区域路由 us.openrouter.ai,与去年 10 月上线的 eu.openrouter.ai 配套,请求在区域内解密并只路由到区域内提供商,全程不出区。
推荐理由:原文区分了推理级与端到端区域路由的差异,并说明区域域名、404 行为和 Guardrails 配置,读者可直接评估合规用法。
针对 AI 编程智能体评测,Google 提出用行为评测替代 Terminal-Bench、DeepSWE 等端到端基准的复合分数,直接断言工具调用等中间执行步骤。
OpenRouter 发布教程,演示如何通过 API 向 google/gemini-3.1-flash-image(Nano Banana 2)发送源图和编辑指令,在代码中完成图片编辑。
Google 发布 Agent Development Kit (ADK) for Kotlin 1.0 正式版,实现与 ADK Python 和 Java 的完全功能对齐,并提供面向 Android 的端侧扩展。
Google DeepMind 发布 AlphaGenome Atlas 平台,包含人类基因组约 90 亿个单核苷酸变异的分子效应预测,数据规模 1 petabyte,超过 AlphaFold Database 30 倍以上。
推荐理由:官方平台发布,覆盖 90 亿个单核苷酸变异预测并附应用案例,可用于了解基因组变异数据资源的最新规模与获取方式。
Google Cloud 的 Gemini Enterprise DevEx 计划本轮聚焦智能体治理,梳理出从配置受治理的智能体身份、注册 Agent Registry、绑定 Agent Gateway,到执行策略与内容安全、验证端到端执行的五步工作流。
Google Research 利用 UK Biobank 约数十万欧洲样本与 Biobank Japan 近 20 万日本样本,在 8 项临床性状上评估多基因风险评分(PRS)的跨人群迁移效果。结果显示,目标人群样本达 15k 以上时,专用模型优于混合欧洲数据训练;而遗传相关性高的性状可继续受益于欧洲数据直至目标样本达 25-40k+。
Google Research 与 HHMI Janelia、MRC 分子生物学实验室及剑桥大学等合作,在 Cell 发表雄性果蝇大脑和中央神经系统的完整连接组,包含超 166,000 个神经元和 1.25 亿个突触连接,是迄今按神经元数量计最大的脑图谱。
推荐理由:由参与方介绍完整雄性果蝇连接组,读者可了解其规模、AI 重建方法及对后续脑映射研究的用途。
Google DeepMind 与 Google Research 发布 WeatherNext 3,称其为最先进准确的全球 AI 天气模型。模型直接学习实时卫星数据和气象站观测,逐小时产出最高 5 公里分辨率预报,精度约为 WeatherNext 2 的五倍;中期降水预报 CRPS 相对 IMERG 提升最高 60%。
推荐理由:官方介绍了新模型的分辨率、逐小时更新和降水精度提升,并说明其在 Google 各产品中的落地方式,读者可评估对天气相关业务的应用价值。
Microsoft MAI 发布转写模型 MAI-Transcribe-2,在 FLEURS 基准 60 种语言上以平均词错率 5.2% 排名第一,定价每小时音频 $0.10(年底前限时)。
Google 推出 Fairwind Program,向 Google Cloud 客户、政府机构和网络安全合作伙伴提供 Gemini 3.8 Flash Cyber 与 CodeMender 组合,可自主发现并修复漏洞,将原本数周的手动修复缩短至分钟级生成可部署补丁。
Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber。
推荐理由:官方给出具体基准数据和定价,可用于对比 3.7 Flash 判断升级性价比,Cyber 版的开放范围也值得安全团队留意。
Google 发布 Fairwind Program,为政府和可信合作伙伴提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具,用于自主发现并修复漏洞,可在组织安全云环境内数分钟生成经验证的补丁。该计划初期面向政府、关键基础设施运营方和核心技术平台开放,已有超过 650 个合作伙伴参与;同时 Google.org 将全球网络安全资金累计提升至超过 1 亿美元。
Google for Startups AI Agents Challenge 评选结束后,官方从高分提交中总结出四种工程模式:双向 MCP、事件驱动并发、同标准降级(Gemini 3.1 Pro 503 时回退 Gemini 3.6 Flash 并共用同一校验函数)、以及模型调用前的分层路由。
推荐理由:文章从真实参赛代码中提炼四个可复用的工程模式,覆盖工具暴露、并发、降级校验和分层路由,可直接迁移到自己的智能体项目。
Google 发布 8 月 AI 更新盘点,推出面向编程与智能体的 Gemini 3.7 Flash,其每百万 token 价格为首发时 3.6 Flash 的一半;同时发布语音转文本模型 Gemini 3.5 Transcribe 和搭载 Tensor G6、运行 Gemini Nano 的 Pixel 11 系列。
Google 与 NASA JPL 在 PNAS 发表 MAPL-EMIT,一个基于 Swin-S vision transformer 的深度学习框架,用于从 EMIT 高光谱卫星数据中自动检测甲烷羽流并定位排放源。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出 agentic video understanding,动态检索视频片段以替代固定帧率处理,token 消耗最多降 88%,成本最多降 66%,准确率最多提升 7%。
推荐理由:官方给出 token、成本与准确率的具体降幅和开启方式,长视频处理场景下可评估是否切换处理模式。
Google 发布 Workspace 旗下图像创建与编辑工具 Google Pics,基于 Nano Banana 模型,将在未来几周内向 Google AI Pro 和 Ultra 订阅者及大部分 Workspace 商业客户推出。
Google 发布 TimesFM-3,一个 330M 参数、在超过 1 万亿时间点上预训练的时间序列基础模型,原生支持零样本多变量预测。模型可在单次前向传播中生成整个预测区间,支持多目标、过去协变量和过去-未来协变量,并在 Gift-Eval、FEV-Bench 和 Time 三个基准上于点预测和概率预测指标中均排名第一。
Google 在 Earth AI 体系下推出实验性研究能力 PPE(planetary prediction engine),从自然语言查询出发自主完成地理空间预测的全流程,包括数据发现、清洗、特征工程、模型训练与评估。
Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者提供一组创意控制和生成式视频能力,可通过 Google AI Studio 中的 Gemini API 使用。
推荐理由:官方披露了场景扩展、首末帧插值、4K 放大等具体能力与可用入口,便于开发者评估是否迁移现有视频生成工作流。
Google 在 Search 的 AI Mode 中推出三项旅行功能:航班价格追踪、积分或里程价格展示,以及通过 AI Mode 直接预订酒店。
Google DeepMind 于 8 月 27 日宣布试点针对专有前沿模型的首个双盲 AI 评测,将外部评测限制在密码学保护的“盒子”环境中,防止模型提前接触测试题导致分数虚高。