跳到正文

Google Developers Blog

developers.googleblog.com · 网站与博客

当前显示全部 AI 相关新闻
切换来源
35 条AI 相关新闻 · 最新在前
9月30日周三
9月24日周四
  1. Google Developers Blog61

    Google Cloud API Gateway 公测支持将 REST API 直接暴露为 MCP 工具

    Google Cloud API Gateway 进入 Public Preview,可充当远程 MCP 服务器,无需单独搭建 MCP 服务器即可把现有 REST 操作变成智能体可调用的 MCP 工具。

    推荐理由:官方宣布 API Gateway 可直接充当远程 MCP 服务器,复用既有鉴权与配额,无需另建 MCP 服务器,适合评估 Agent 接入现有 API 的路径。

9月23日周三
  1. Google Developers Blog65

    Antigravity SDK 支持本地模型,首发接入 Gemma 4 26B A4B 与 LiteRT

    Google 宣布 Antigravity SDK 支持本地工作流,首发支持通过 Google AI Edge 的 LiteRT 运行 Gemma 4 26B A4B,可完全离线提供智能体能力,建议机器配备 24GB 以上 VRAM 或统一内存。

    推荐理由:原文给出本地运行智能体的具体配置方法和混合编排演示数据,开发者可以直接照此把智能体工作流搬到本地 GPU 上。

9月22日周二
  1. Google Developers Blog42

    Google Colab 纳入 Google AI 订阅计划

    Google AI 订阅用户现可直接获得 Colab 高级权益,包括优先使用更快的加速器和更强算力的机器。Google AI Ultra 订阅者还可解锁不间断后台执行和 Premium GPU 访问,长时间训练无需保持浏览器标签页开启。该权益将在未来几周内向 Colab 支持国家的 Google AI 订阅用户逐步推送,已有 Colab 订阅不受影响。

9月17日周四
9月16日周三
9月15日周二
9月11日周五
9月9日周三
9月4日周五
9月2日周三
  1. Google Developers Blog62

    Google 复盘 AI Agents Challenge 最强提交背后的 4 种工程模式

    Google for Startups AI Agents Challenge 评选结束后,官方从高分提交中总结出四种工程模式:双向 MCP、事件驱动并发、同标准降级(Gemini 3.1 Pro 503 时回退 Gemini 3.6 Flash 并共用同一校验函数)、以及模型调用前的分层路由。

    推荐理由:文章从真实参赛代码中提炼四个可复用的工程模式,覆盖工具暴露、并发、降级校验和分层路由,可直接迁移到自己的智能体项目。

8月27日周四
  1. Google Developers Blog43

    用深度学习和 Keras 解码宇宙信号

    Google 开发者博客介绍深度学习在天体粒子物理中的应用:Pierre Auger 天文台用 1500 多个探测器站覆盖 3000 平方公里,IceCube 以约 1 立方公里南极冰探测中微子,这些观测设施的空间分布传感器记录波形数据,结构类似图像,适合用深度学习分析。文章聚焦深度学习如何提升仪器灵敏度、发现隐藏模式并搜寻信号异常。

8月26日周三
  1. Google Developers Blog35

    Google Cloud 在 Cloud TPU 上为 vLLM 带来企业级长上下文多模态嵌入推理

    Google Cloud 将原生 TPU 支持集成进 vLLM,用于在 Cloud TPU 上服务 Qwen3-Embedding 系列嵌入模型,支持 4K+ token 文本与 15K+ token 多模态输入的长上下文。团队针对 TPU 做了词表 padding、懒加载初始化与 StepPool 长上下文等优化,并以余弦相似度验证数值一致性,文本目标阈值 ≥0.999、多模态 ≥0.995。

8月24日周一
8月17日周一
  1. Google Developers Blog43

    Gemini Enterprise Agent Platform 新增 Parallel Web Search 网页接地选项

    Google Cloud 与 Parallel Web Systems 合作,将 Parallel 的搜索基础设施作为网页接地(grounding)提供商原生集成到 Gemini Enterprise Agent Platform,让开发者用可验证的实时网页结果锚定 AI 智能体,提升复杂企业工作流的事实准确性。该合作还支持以编程方式提取、永久缓存并处理网页数据,并可与其他大语言模型配合使用。

  2. Google Developers Blog35

    Google Tunix:用高吞吐 Agentic RL 训练多轮工具调用智能体

    Google 推出 JAX 原生后训练库 Tunix,用于消除训练多轮、工具调用型 LLM 推理智能体时的 TPU 闲置瓶颈。它通过高并发异步 rollout 与解耦的生产者-消费者流水线提升硬件吞吐,让训练器在智能体等待网络 I/O 或环境步骤时仍持续获得数据。Tunix 还提供即插即用抽象与持续的宏观层面 profiling,便于接入自定义开源环境并优化分布式工作流。

  3. Google Developers Blog28

    如何用 Google 微基准测试评估 TPU 性能

    Google 开源 TPU 微基准测试套件,可从 Network、Compute、HBM、Host Transfer 和 Attention 五个组件提供细粒度性能指标,用于验证真实硬件能力。借助这些基准建立 Roofline 模型,工程师能判断机器学习负载受限于计算、内存还是网络,并据此开展 kernel 调优、mesh 分片和重计算等针对性优化,提升大规模模型部署的硬件利用率。

  4. Google Developers Blog25

    用会话感知负载均衡扩展实时 AI 智能体

    实时 AI 智能体依赖长连接、有状态的双向流,使传统请求-响应式负载均衡无法反映服务器真实容量。开发者需在运行时内实现应用层会话追踪,准确统计活跃对话的并发负载,并将精确会话数与 CPU 利用率一并输入混合路由算法,从而有效分发有状态 AI 流量,避免单个后端成为瓶颈。

  5. Google Developers Blog38

    Genkit Go 推出 Agent Skills:按需加载技能,减少 token 消耗

    Genkit Go 引入基于渐进式披露架构的 Agent Skills,开发者可将专用指令、脚本和参考资料打包成模块化 SKILL.md 技能包,初始仅向智能体系统提示词暴露 frontmatter 元数据。当任务匹配技能描述时,Genkit 中间件动态加载完整指令正文与相关资源,从而避免上下文窗口膨胀并降低 token 消耗。

  6. Google Developers Blog44

    Conductor 升级为可移植插件,支持 Antigravity 与 Claude

    Conductor 从 Gemini CLI 扩展升级为可移植插件,将对话式规格驱动开发(SDD)带入 Antigravity CLI 和 Claude 等生态。开发者无需依赖严格命令序列,可自然对话,由 AI 助手在后台动态管理 spec.md、plan.md 等持久化 markdown 产物。该更新消除了工作流摩擦,并让仓库成为跨 AI 工具、受版本控制的项目架构与状态唯一来源。

8月13日周四
  1. Google Developers Blog56

    Google 开源 C++ 库 Credentio,用于本地验证 C2PA Content Credentials

    Google 发布开源 C++ 库 Credentio,用于处理 C2PA Content Credentials,先支持规范 2.2 和 2.4 版本。该库支持完全本地验证,无需将媒体文件传到云端,零带宽开销、即时返回结果并保持数据隐私;验证大文件时内存占用较小,可配置官方或自定义 C2PA 信任列表,深入解析清单、断言、数字签名和声明结构,并给出详细的验证报告。

8月11日周二
  1. Google Developers Blog44

    为什么 Go 是 AI 辅助软件工程的理想语言

    Google 发文论证 Go 是 AI 辅助软件工程的理想语言:当 AI 智能体可秒级生成数百行代码,开发者重心从编写转向审查与维护,语言的可读性和工具链一致性变得更重要。Go 自带格式化、测试框架、依赖管理与安全工具,能让 AI 更快、更便宜、更可靠地处理代码,并减少上下文窗口污染与 token 成本。