Gemini Live 面向全球免费开放。各集成功能的可用范围、兼容性和年龄限制存在差异,部分集成可能需要完成设置或订阅。官方博客给出了具体使用方式。
推荐理由:Gemini Live 免费向全球开放,读者可据此了解各集成功能在可用范围与年龄限制上的差异。
Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。
当前仅显示精选新闻Gemini Live 面向全球免费开放。各集成功能的可用范围、兼容性和年龄限制存在差异,部分集成可能需要完成设置或订阅。官方博客给出了具体使用方式。
推荐理由:Gemini Live 免费向全球开放,读者可据此了解各集成功能在可用范围与年龄限制上的差异。
Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者提供一组创意控制和生成式视频能力,可通过 Google AI Studio 中的 Gemini API 使用。
推荐理由:官方披露了场景扩展、首末帧插值、4K 放大等具体能力与可用入口,便于开发者评估是否迁移现有视频生成工作流。
推荐理由:交易按约 80 倍前瞻收入定价,原文给出 Nvidia 借开源模型维护 GPU 需求的战略逻辑,可据此理解其收购动机。
Google 发布 Gemini 3.5 Transcribe,一款不再逐字记录、而是输出用户本意的语音转写模型,现已通过 API 开放。

Say hello to Gemini 3.5 Transcribe! - Build apps that understand user speech / intent, even w/ multiple speakers! - Auto-detection of 85+ languages out of the box - Custom vocab adaptation for specialized jargon... SGTM:) API available now in @GoogleAIStudio and Gemini Enterprise, or try it in the Gemini app on macOS or Rambler on Android! More details: https://t.co/AduutCb3M7
推荐理由:原文列出两个 API 端点各自的能力与时长限制,读者可据此判断语音转写在工作流中的可用边界。
Gemini App 宣布 Gemini Live 现在可以对 Gmail 执行操作,包括总结未读邮件、搜索指定发件人以及归档邮件线程。用户通过语音提出请求即可完成这些操作,不必翻查冗长的邮件链。
推荐理由:官方说明 Gemini Live 可对 Gmail 直接执行总结、搜索与归档,读者可据此判断语音操作邮箱的实用边界。
Google DeepMind 推出语音转文字模型 Gemini 3.5 Transcribe,定位为更精确的实时转写模型,已在 Gemini API(Google AI Studio 和 Gemini Enterprise Agent Platform)开启公开预览。
推荐理由:官方给出了两个 API 入口、WER 数字和与 Chirp 3 的对比,读者可据此评估其语音转写与语音交互场景的可用性。
Google 发布 gemini-omni-1.1-flash,即对话式视频生成与编辑模型 Gemini Omni Flash 的 GA 版本。新增视频延伸、首尾帧插值(最多 2 张图)以及 360p 到 4K 的分辨率参数,1080p 和 4K 通过超分辨率生成;预览端点 gemini-omni-flash-preview 将于 2026 年 9 月 30 日弃用。
推荐理由:官方更新日志给出 GA 版本的新能力清单和预览端点停用时间,开发者可据此规划迁移。
阿里发布 Qwen3.8-Flash,并在 Hugging Face 与 ModelScope 开放同一模型的 Qwen3.8-Flash-Next 权重,主模型 125B 参数、每 token 仅激活 6B,千问 AI 平台定价为每百万 token 输入 1 元、输出 3 元。
推荐理由:文章拆解了 Qwen3.8-Flash 在注意力、残差与嵌入上的四处架构改动,并把它放进每任务成本的行业对比框架里。
2026 年 8 月,MATS Research、ELLIS Institute Tübingen 与 Max Planck Institute for Intelligent Systems 的研究者测试了 Anthropic、OpenAI 和 Google 返回给客户端的加密推理块,发现把块重放进同族更便宜的模型,就能让隐藏推理以明文输出。
推荐理由:研究揭示加密推理块可被同族小模型复述,公开 agent 日志里的密钥无法靠清洗明文保护。
Google 发布 Gemini 3.7 Flash,官方将其定位为迄今最智能的工作马模型,Google 高管发推称这是其史上增长最快的一次模型发布。
Gemini 3.7 is our fastest growing model launch to date, amazing to see the reception!!!
推荐理由:文章给出 Gemini 3.7 Flash 的代码评测与价格变化,并讨论低价模型对 Agent 算力成本结构的影响。
Anthropic 宣布 computer use、Skills API 和 Files API 在 Claude Platform 正式可用,computer use 同时新增 browser use 工具,除截图外还读取页面结构,让智能体定位具体字段或按钮。
推荐理由:正式版给出了多动作执行、浏览器工具和文件存储的具体变化,可据此判断现有智能体工作流的改造空间。
推荐理由:公告给出面向 140+ 国家大学生的免费 Google AI 订阅,可据此了解其教育侧的推广范围。
推荐理由:官方给出可直接复用的提示词开头方式,读者可据此在对话里生成可交互的 3D 模拟与动态表格。
推荐理由:Gemini 把学生专区、学习笔记本与 Deep Research 打包进应用并附一年免费方案,可观察教育场景的落地方式。
推荐理由:面向在校学生的免费订阅覆盖美国与 140 多个国家,可据此比较各家 AI 产品在学生市场的推广力度。
Updates on GitHub support in @GoogleAIStudio: - we now support importing Github repos - we now support bi-directional GitHub sync (push / pull) - brand new UI support for force pushes, merges, etc Bi-directional push / pull took a while to land but excited it is here! https://t.co/0S4GeZZu90
推荐理由:Google AI Studio 的 Build 功能补上 GitHub 仓库导入与双向同步,读者可以据此判断它能否接入现有代码流程。
Google 宣布在 Search 的 AI Mode 和 AI Overviews 中推出 5 项学习工具。
推荐理由:原文列出了五项学习功能各自的入口、覆盖范围和上线节奏,读者可以据此了解 Google 搜索在 AI Mode 里的教育能力布局。
xAI 发布免费插件 Grok for Google Workspace,一次从 Google Workspace Marketplace 安装即可覆盖 Sheets、Slides 和 Docs,同时还提供 Microsoft 365 的 Word、Excel、PowerPoint 和 Outlook 版本。
推荐理由:原文列出 Grok 在 Sheets、Slides、Docs 中各自能做的事与免费安装入口,可据此判断它对文档办公流程的影响。
Gemini Enterprise Agent Platform 的智能体与模型评估服务现已正式可用,为开发者提供统一引擎,在本地开发实验与线上生产流量中一致衡量智能体质量。
推荐理由:评估服务正式可用并给出 20 多项指标与接入入口,读者可据此判断智能体评测如何融入现有开发流程。
Agent Plugins 1.0.0 是一项厂商中立的目录规范,由 Google、Amazon、Microsoft 等支持,可将 Agent Skills 与 MCP server 打包成单一可移植单元。
推荐理由:规范统一了 Agent Skills 与 MCP server 的打包方式,读者可据此判断跨 IDE 兼容的成本。