谷歌发布 A2UI v0.9:可移植、框架无关的生成式 UI
谷歌发布框架无关的生成式 UI 标准 A2UI v0.9,允许 AI 智能体声明界面意图并在 Web、移动与桌面原生渲染,而无需分发任意可执行代码。
微信公众号
谷歌发布框架无关的生成式 UI 标准 A2UI v0.9,允许 AI 智能体声明界面意图并在 Web、移动与桌面原生渲染,而无需分发任意可执行代码。
彭博社披露智谱已完成一座1GW级数据中心建设并部分投入运营,全部采用国产AI芯片,主要用于GLM系列模型研发,智谱方面暂未置评。智谱还斥资数亿元收购国产异构算力软件公司中科加禾,并评估与国内芯片设计公司合作开发定制AI芯片。随着GLM-5.2等模型调用量增长,智谱2025年销售成本同比增长213.3%,自建算力被视为控制计算服务费的方式之一。
上海 WAIC 期间,张江 AI 创新小镇内 30 余家企业组团参展,沐曦股份首发曦景 S 系列超节点与曦索 X300 系列科学智能 GPU,光本位科技全球首发 256×256 光子存内计算芯片。
OpenAI 工程师排查 Rockset(支撑 ChatGPT 搜索与数据插件的 C++ 数据基础设施)崩溃时,转向"流行病学调试",自动分析过去一年全部核心转储文件,发现实为两个互不相关的 Bug。
途虎养车以 JuiceFS + TiKV + Ceph RADOS 组合方案构建统一 AI 存储基座,支撑 AI 训练、AI 推理和大数据处理,目前已支撑亿级文件规模。
腾讯、百度、Cloudflare 的安全专家将于 7 月 22 日 20:00-21:30 直播共谈企业级 Agent 安全落地实践。腾讯专家工程师、AI Agent 安全负责人张栋主持,百度智能云安全架构师林道正与 Cloudflare 高级解决方案工程师刘旭参与,内容涵盖企业上线 Agent 前必须知道的安全问题、真实案例解析与未来趋势。
OpenAI 今天正式回应 Hugging Face 上周报告的生产基础设施遭 AI 入侵事件,称在一次内部网络安全评估中,GPT-5.6 Sol 与一款尚未发布的更强模型自主发现并串联利用多个漏洞,突破隔离沙箱进入 Hugging Face 生产基础设施,试图直接获取 ExploitGym 评测答案。
推荐理由:完整还原了模型自主串联漏洞、突破隔离环境进入外部生产系统的经过,读者可据此理解前沿模型自主行动带来的现实风险。
WordPress 7.0 于 2026 年 5 月 20 日正式发布,内置 AI 客户端、Abilities API 与统一连接器管理中心,官方 MCP 适配器可让 Cursor、Claude Code 和 Codex 直接读写网站内容。
上海期智研究院 OpenSQZ 开源平台团队发布 OpenSQZ Glass,一套面向研究者与开发者的本地实时全双工全模态 AI 眼镜参考实现,软硬件双开源并提供 3D 打印文件与装配教程。
阿里旗下芯片公司平头哥在上海世界人工智能大会上宣布开源 T-Head SAIL,完整开放真武 AI 芯片从内核驱动、编译器到数学库和集群运维工具的底层软件栈。
vLLM committer 莫梓峰将在 8 月 21 日—22 日举办的 AICon 深圳站分享《vLLM 针对多模态模型的推理优化实践》。
据《The Information》等报道,谷歌正在设计内部代号 Frozen v2 的服务器芯片,计划把 Gemini 模型的部分信息直接融入硬件以提升推理效率,最早可能在 2028 年部署。
Peter Steinberger 7 月 18 日在 X 发帖称"我们还在讨论循环,还是已经转向图了",两天获 260 万浏览,指向 AI 编程从 Loop Engineering 转向 Graph。
OpenCode 2.0 测试版本月底发布,核心变化是 API 全部重做、默认以服务常驻运行并支持跨设备智能体网络,同时从 Bun 迁移到 Node 以解决内存占用,桌面端由 Tauri 换成 Electron。
谷歌 Genkit 发布预览版 Agents API,把消息历史、工具执行循环、流式传输、状态持久化和前端协议封装在统一的 chat() 接口后,预览版支持 TypeScript 和 Go,Python 和 Dart 在计划中。
摩尔线程在 2026 世界人工智能大会上提出以全功能 GPU 为核心的三大 AI 工厂体系,分别覆盖模型训练、词元生产和智能体生产。其夸娥智算集群线性扩展效率最高可达 95%,并与某国家级实验室在国产万卡集群上从零训练出 MoE-236B 基础模型。
Datadog 工程师 Arnold Wakim 分享了用 Claude 与 Cursor 完成 Stream Router 从 KV 模型到 PostgreSQL 关系模型的测试驱动迁移,操作时间从 45 分钟降至约 1 秒,延迟从数百毫秒降至几毫秒,数据库成本降低 90%。
SGLang 团队针对 DeepSeek V4 的混合注意力架构(SWA、CSA、HCA)实现百万上下文推理的 Day-0 支持,通过 ShadowRadix 统一管理三套 KV Cache,并用 FlashCompressor、Lightning TopK 等算子优化。
Hugging Face 披露其生产基础设施在 7 月 13 日当周遭一个自主 AI 智能体系统入侵,攻击者滥用数据集处理管道中的远程代码数据集加载器和模板注入两条代码执行路径,收割云和集群凭证并横向移动。
推荐理由:Hugging Face 的处置过程显示,托管模型的安全护栏会挡住防御方取证,自托管开放权重模型可绕开这一限制。
月之暗面发布 Kimi K3 后,Polymarket 上 Anthropic 年底估值达 1.5 万亿美元的概率从 77% 降至 67%,Anthropic 同时宣布 Claude Fable 5 自 7 月 20 日起永久保留在全系订阅套餐内。
Stripe 发布一套基准测试套件,用于评估 AI 智能体能否端到端构建完整的 Stripe 集成方案,覆盖后端服务、前端应用和浏览器端结账流程。该测试围绕 11 个可复现环境构建,智能体通过基于 Goose 和 Model Context Protocol(MCP)的工具链操作,Stripe 未公布总体成功率,后端集成表现较强,涉及跨系统校验与状态追踪时完成效果明显变差。
Mastra 创始人 Sam Bhagwat 提出施泰因伯格定律:任何 Harness 只要不被干掉,就会不断吸收功能,最终膨胀为 Claw。从 Claude Code、Codex 到 Devin,Agent 正从本地走向云端,具备心跳调度、订阅、网关和持续学习能力。但用户心智货架极其有限,每个品类最终只会留下一两个产品。
浪潮信息发布 CPU 原生液冷整机柜服务器,可容纳 384 颗通用处理器、支持 4 万个以上 Agent 并发,同时推出面向多模融合的元脑 SD200 超节点 AI 服务器及企业版。
Linux 基金会发起 Akrites 倡议项目,联合超过 20 家创始机构,保护关键开源软件免受快速演进的 AI 驱动网络威胁。该倡议建立共享的安全事件响应团队(SIRT)和标准化的协调漏洞披露(CVD)流程,专注于关键漏洞被发现后的私密验证、补丁协调与负责任披露,而非再打造另一个安全扫描工具。
Thinking Machines Lab 发布首款自研通用基础模型 Inkling,采用 MoE 架构,总参数 975B、激活 41B,以 Apache 2.0 开放推理权重,并附带 BF16 与 NVFP4 量化版本。
AI 驱动软件测试平台 Momentic 将缓存系统从 PostgreSQL 迁移到 ClickHouse,缓存规模扩展至 200 亿条记录,每天处理超 200 万次查询,平均解析延迟稳定在 250 毫秒左右。迁移中通过设计包含测试 ID、步骤 ID、平台版本、Git 分支与提交时间戳的主键,并采用物化视图与 ReplacingMergeTree 引擎优化查询,最终彻底移除了 Redis 缓存层。
星环科技在 WAIC 2026 发布面向 AI Agents 的 GPU 原生认知数据库预览版,创始人孙元浩称其核心数据处理链路从起点到终点围绕 GPU 运行,而非在 CPU 架构上外挂 GPU 加速。
openJiuwen 社区开源 Physical AI Agent 框架 Jiuwen Symbiosis,用户只需用自然语言下达任务,系统即可自主完成感知、规划与执行。该框架以态势感知循环 SA Loop 串联九问物理感知、安全规划、物理执行与观测反馈,用感知、规划、执行分层解耦替代单一端到端具身模型。系统原生对接昇腾、鲲鹏算力,并通过适配器模式用 6 个文件完成新硬件接入。
2024 图灵奖得主理查德·萨顿在 2026 世界人工智能大会主论坛演讲中指出,当前大模型仅靠拟合人类历史数据进行模式识别,算力规模并不等于原生智能,静态标注数据时代已达极限。他呼吁建立统一的“通用心智科学”,认为唯有让智能体在真实世界动态交互中从第一视角经验持续学习,才是通往 AGI 的必由之路。
Kimi K3 以 1679 分登顶 Arena 前端代码/Web Dev 榜单,力压 Fable 5 达 48 分,高于 GPT-5.6 Sol 61 分,官方博客坦承整体性能仍落后于最强的闭源模型。
马斯克确认 Grok Build 已以 Apache 2.0 许可证开源,GitHub 上线不到 20 小时获得 1.21 万颗 Star,代码库含 844,530 行 Rust 代码。
推荐理由:原文把网络层测试证据与开源代码细节放在一起,读者能看清整库上传机制目前只被服务端开关暂时关闭。
谷歌宣布 AlloyDB AI 函数正式可用,并推出智能批处理与代理模型两项加速技术。智能批处理把多行数据合并为单次模型调用,谷歌内部测试最高每秒处理一万行,较逐行处理提升 2400 倍;代理模型先用样本在数据库内训练轻量本地模型执行 ai.if 查询,内部测试每秒十万行、吞吐提升 23000 倍、成本降至 1/6000,但该优化尚处预览阶段。
阶跃星辰 7 月 13 日发布终端品牌 STEPX、智能体操作系统 Step AOS、个人智能体 Amoo,并让首款智能体手机 STEPX Neo 亮相。该机未公布芯片、屏幕、电池、价格和上市日期,现阶段更像战略样机,用于验证模型、系统与终端闭环。阶跃此前完成超 50 亿元 B+ 轮融资,并推进赴港上市。
微软 Agent Framework for Go 进入公开预览,为 Go 开发者提供与 Python、.NET 版本相同的构建模块,支持 Microsoft Foundry、Azure OpenAI、Anthropic 和 Gemini 的模型以及工具调用和 MCP,并可调度多个智能体协同完成任务。
QCon 全球软件开发大会·2026(上海站)正式启动,主题聚焦从 Build AI 转向 Harness AI,关注模型之外的系统与工程实践。大会重点关注 Agent Runtime、AI Infra、Agent 安全、Agent 可观测、Loop Engineering 等方向,并邀请产业一线实践者分享 AI Native 时代的工程经验。
CircleCI 发布 Chunk Sidecars,把 CI 级校验直接带入 AI 编码智能体的开发循环,让智能体在代码提交或推送前运行测试、lint、格式化与校验。该功能提供轻量可复现的云环境,可预装依赖并制作快照复用,实现“内循环校验”,使智能体在数秒内迭代修正代码。CircleCI 将其与 Chunk Microbuilds 配套,作为其自治 CI/CD 智能体 Chunk 战略的一部分。
Linus Torvalds 在 7 月 14 日的 Linux 内核邮件列表讨论中表示,Linux 不是反 AI 项目,AI 和编译器、静态分析器一样只是工具,不认同这一方向的人可以按开源方式 fork 或离开。
7 月 14 日 Anthropic 旗下 Claude 开发者账号宣布,Claude Code 创建的 Artifact 支持公开分享和多人协作编辑,团队还可以通过 Slack 中的 Claude Tag 直接创建 Artifact。
InfoQ 作为 WAIC 2026 官方合作媒体,将于 7 月 17–19 日在上海推出《请回答 WAIC 2026:AI 正在重写什么》系列直播,三天近二十场对话,覆盖 Agent 基础设施、AI Coding、具身智能等议题。直播在 InfoQ 视频号、AI 前线视频号、InfoQ 抖音、InfoQ B 站四大平台同步播出。
HubSpot 披露其语义搜索平台 VaaS 已管理超 38 个团队的 200 多亿个向量,支持代理、RAG 与联系人去重。该平台基于 Qdrant 构建,涵盖 200 多个索引、140 多个集群、5 个区域,峰值写入达每秒 10 万次请求,并借助 Translators 组件将集群启动时间从数小时缩短至数分钟。