Gemini 3.8 Flash TTS 与 Flash-Lite TTS 正式 GA,并上线 Voices 端点
Gemini 3.8 Flash TTS(gemini-3.8-flash-tts)和 Gemini 3.8 Flash-Lite TTS(gemini-3.8-flash-lite-tts)正式 GA,同时上线 Gemini API Voices 端点(/v1beta/voices)。
ai.google.dev · 网站与博客
Gemini 3.8 Flash TTS(gemini-3.8-flash-tts)和 Gemini 3.8 Flash-Lite TTS(gemini-3.8-flash-lite-tts)正式 GA,同时上线 Gemini API Voices 端点(/v1beta/voices)。
Gemini API 更新日志显示,Gemini 2.5 系列模型访问权限被限制为过去曾活跃使用过它们的用户,官方称此举是为保证整体性能可靠。这些模型并未被弃用,仍将通过 API 继续提供服务直至另行通知。新项目则被建议改用最新的 3.5 Flash-Lite 或 3.8 Flash。
Antigravity Agent 发布 antigravity-preview-09-2026,取代并弃用 antigravity-preview-05-2026。
Google 在 Gemini API 中正式发布 Gemini 3.8 Live(gemini-3.8-live)与 Gemini 3.8 Live Extended Thinking(gemini-3.8-live-extended-thinking)两个面向实时语音的音频到音频模型。
Google 在 Gemini API 中宣布 lyria-3.5 正式可用(GA),这是其下一代音乐生成模型,支持整首歌生成,音乐连贯性、人声和时长与结构的细粒度控制均有提升。模型支持文本和图像输入,可生成 44.1 kHz 立体声高保真音频,详情和代码示例见 Music generation guide。
Google 发布 gemini-3.8-flash 正式版(GA),称其为此前最智能的 Flash 模型。该模型面向长程软件工程、自主智能体和企业复杂工作流,可通过 Gemini API 模型页面和最新模型指南上手。
推荐理由:官方宣布 gemini-3.8-flash 转正为 GA 版本,定位长程软件工程与智能体场景,可据此评估是否替换现有 Flash 调用。
Google 在 Gemini API 中为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出智能体式视频理解,覆盖 Interactions 和 GenerateContent 两个 API。模型可动态导航视频时间线,按需请求转录文本、帧或音轨,长视频内容相比静态处理的 token 用量最多减少 88%。
推荐理由:官方更新日志给出按需取用视频素材的机制和 88% token 节省数字,便于评估长视频处理的成本变化。
Google 发布 gemini-omni-1.1-flash,即对话式视频生成与编辑模型 Gemini Omni Flash 的 GA 版本。新增视频延伸、首尾帧插值(最多 2 张图)以及 360p 到 4K 的分辨率参数,1080p 和 4K 通过超分辨率生成;预览端点 gemini-omni-flash-preview 将于 2026 年 9 月 30 日弃用。
推荐理由:官方更新日志给出 GA 版本的新能力清单和预览端点停用时间,开发者可据此规划迁移。