美团复盘全员养虾日耗上千万元,OpenClaw 创始人讲述爆火后差点删掉项目
美团复盘今年 2 月至 3 月的全员“养虾”运动,把 OpenClaw 引入公司后 AI 账单每天烧掉上千万元,部分谬误甚至干扰真实经营,直到 7 月才通过赛马机制跑出可用场景。
微信公众号
美团复盘今年 2 月至 3 月的全员“养虾”运动,把 OpenClaw 引入公司后 AI 账单每天烧掉上千万元,部分谬误甚至干扰真实经营,直到 7 月才通过赛马机制跑出可用场景。
InfoQ 2026 年文化与方法趋势报告指出,AI 采用已陷入“要么全有、要么全无”的两级模式,讨论小组呼吁建立基于风险的成熟度框架。报告引用 GitHub 数据称,PR 数量将从去年约十亿个增至 2026 年预测的一百四十亿个,代码变更总量暴涨至 14 倍;Sonar 2026 年调查显示 AI 已占提交代码的 42%,但 96% 的开发者并不完全信任它们,仅 48% 会在提交前验证。
阿里云在 8 月 14 日飞天发布时刻推出企业级 Agent 全栈平台 Agent Studio,并已上线阿里云百炼,把托管运行、工具接入、记忆与检索等能力收敛为一站式服务层。
Zilliz 联合创始人兼产品副总裁郭人通已确认出席 AICon 深圳站“超级个体与蜂群智能的共生进化”专题,发表《Agentic-Native 增长:Zilliz 如何用 AI Agent 支撑超线性业务扩张》主题分享。
Uno Platform 6.6 发布,为 Android、iOS、Linux、macOS 和 Windows 引入原生 AOT 支持,在 .NET 10 上的 Chefs 示例中启动性能提升从 iOS 的 21% 到 Android 的 61% 不等。
腾讯 DataBuddy Harness 工程负责人彭锦文将在 8 月 21 日—22 日举办的 AICon 深圳站分享《DataBuddy:数据语义驱动的企业 Agent Runtime 设计与落地》,拆解 DataBuddy 如何用一套 Agent Runtime 回答执行可控、语义可信、系统可进化三个核心问题。
具身智能行业从VLA与世界模型的路线之争转向“路线混搭”,WAIC 2026上展示的模型已从去年以VLA为主变为“世界模型+VLA”占绝大多数。
openJiuwen 将旗下蜂群智能体升级为 WorkSwarm,率先上架鸿蒙 PC 应用市场,并支持 Windows、Mac 等平台。WorkSwarm 提供单 Agent 与集群两种模式,可自主组队、共享上下文并接力成果,集群模式下 20 分钟交付 200 页 PPT,还能在 Code 空间完成 ArkTS 应用开发。openJiuwen 社区官网已上线体验环境并提供海量免费 Token。
Anthropic 联合创始人兼 CEO Dario Amodei 于 8 月 16 日在 X 发文,称公众对 AI 的负面情绪根源于一场信任危机,AI 公司尚未兑现让世界变好的承诺,该帖浏览量已超 1000 万。
中国银行广州分行推出国内首个"Token 贷"产品,以算力 Token 消耗量作为授信依据,目前授信 5 户 2800 万元、已投放 3 户 800 万元。Anthropic 自 8 月 2 日起在全球 Claude 可用模型输出中嵌入难以察觉的水印,并称将开放免费 API 供第三方检测。
DeepSeek-V4-Pro-0813 上线不到 24 小时即遭遇口碑反转,官网一度撤下 V4 Pro 正式版横幅和开放平台公告。
IBM 和 Red Hat 宣布扩展 Lightwell 并推出新的商业产品,帮助组织为 AI 辅助软件开发建立可信、可验证的软件供应链。新产品基于开源 Lightwell 项目,整合 Sigstore、in-toto、SLSA 和 SBOM 等标准,提供工件签名、来源信息生成、策略验证和生命周期管理能力,让企业无需自行拼装多个割裂的开源项目。
Anthropic 宣布 Claude Sonnet 5 的初始定价永久保留,输入每百万 Token 2 美元、输出 10 美元,取消原定 8 月 31 日后上调至 3 美元和 15 美元的计划。
Brex 的 AI 工作流平台采用与运行时无关的编排模式,把编排逻辑写成只依赖类型化 Steps 接口的普通函数,生产环境用 Temporal 适配器、评估用进程内适配器,两端跑的是同一份编排代码。
北京时间 8 月 14 日,智谱发布 GLM-5.3,已向全部 GLM Coding Plan 用户开放,并可用于 ZCode、Claude Code、OpenCode 等 Coding Agent。
由 MATS program 研究员 Alexander Panfilov 领衔,马克斯·普朗克智能系统研究所、图宾根 ELLIS 研究所与 Snyk 联合发表的论文《Stealing Reasoning Traces from Proprietary LLM APIs》指出。
Uptime Labs 在 Incident Fest 研讨中指出,AI 自动化越多,人类专业知识在复杂故障中越关键。研究显示 AI 诊断准确时处置效率远超无协助状态,但建议错误时人类表现反而不如不用 AI。随着常规事故减少,工程师实操历练退化,企业需通过故障演练、混沌工程等方式维持人员技能。
华为鸿蒙 AI 基础软件技术专家丁天虹将在 2026 年 AICon 深圳站分享《从入鸿蒙到 AI Native:系统与 AI 融合下的应用智能化跃迁》,围绕系统智能体、端侧推理、可信安全和生态应用协同,结合 OpenHarmony Agent TSG 推进的三个生态实践展开。
DeepSeek 于 8 月 13 日面向开发者开放 DeepSeek Harness 开发者预览版,首个版本为 v0.1,并以 MIT 协议开源。该框架把模型、工具、技能、会话、沙箱、存储、Agent Loop、调度和 UI 全部做成可替换插件,基于 Cordis 插件系统,当前提供标准、PTC、极简和创造四种运行模式。
Vercel Labs 发布实验性系统编程语言 Zero,定位为一门速度更快、体积更小且更便于 AI 智能体使用和修复的系统语言,目前版本为 v0.3.4,GitHub Star 超过 5200。
Anthropic Claude Code 团队主导插件与 Agent 设计的 Daisy Hollman 在 NDC Copenhagen 演讲中,拆解了 Claude Code 插件的构成与其上下文工程原语。
良仓孵化器创始合伙人苏杰在 QCon 2026 北京站上,由 AI 数字分身完成主体演讲,提出 AI 折叠时间将解构方法论与岗位边界,未来只有 to C 和 to A,to B 产品将消失。他判断产品形态从“预制菜”式软件转向即用即做的“轻产品”,真正值钱的是生成系统,GitHub 可能成为下一代应用商店。
鸿蒙元服务通过 ASCF 跨端框架把已有小程序代码直接迁移为场景卡片,京东借此拆分出 200+ 场景卡片并自动适配直板机与折叠屏。ASCF 支持 JavaScript/TypeScript 代码自动转换,一个 20K+ 工程代码的小程序被识别出 121 处异常并由 AI 全量自动修复,左邻永佳则将约 45 人天工作量压缩至 15 人天。
腾讯云 IaaS 前沿技术团队负责人金峰在 InfoQ 采访中介绍了 Cube Sandbox 从 Serverless 底座演进为 Agent 沙箱的过程,其冷启动时间不到 60ms,2026 年 4 月正式开源。
微软正式发布 Agent Framework 的 Harness 运行时和 Foundry Hosted Agents 托管目标,该框架由此从 SDK 阶段进入受支持的生产运行时,可作为单个二进制文件跨本地、容器和托管部署环境运行。
网龙网络资深技术总监陈洁将在 2026 年 AICon 深圳站分享《从 AI Coding 到 AI Native SDLC——企业级人机协同研发范式的演进与落地》,结合 2025 年 10 月以来的行业变化与公司 AICT Team 实践,说明如何把个人提效工具演进为企业级 AI Native SDLC。
Composio 让同一个模型 DeepSeek V4 Flash 分别在 8 种智能体 Harness 中完成 30 项任务,Pi Agent 通过 20 项、成功率 66.7% 排名第一,Oh My Pi 通过 17 项,Claude Code、Codex 和 Deep Agents 均通过 16 项,OpenCode 通过 14 项垫底。
在 2026 世界人工智能大会期间的 InfoQ 直播间,滕昱与唐飞虎围绕 AI Coding 展开讨论,两人在 AI 是否具备判断力上存在分歧,但一致认为 AI 正在优先放大资深工程师的经验与判断能力。
Meta 超级智能实验室 8 月 10 日发布 300 亿参数的 Muse Glimmer,以 Apache 2.0 开放权重,专为持续运行的本地智能体工作流优化,可在配备单张消费级 GPU 的 Mac 或 PC 上运行,并支持超 100 种语言。
网易游戏、网龙、平凯数据库(TiDB)与汇丰科技的技术负责人围绕 Coding Agent 落地生产环境展开讨论,指出遗留代码改造需求大于新功能开发,金融等行业客户的多阶段人工审批让流程更复杂。
Bun 创始人 Jarred Sumner 用约 50 个并行运行的 Claude 智能体,耗时 11 天将 Bun 从 Zig 移植到 Rust,按 API 定价花费约 16.5 万美元,生成超过 100 万行 Rust 代码;据 Sumner 称,该项目在全部受支持平台上 100% 通过了 Bun 自身超过 100 万条断言的测试套件。
InfoQ 整理了一篇反驳「写代码从来都不是难点」的长文,以及它在 Hacker News 和 X 上引发的两派争论,并提到 Anthropic 将从 8 月 14 日起让 Auto Mode 成为 Claude Code 面向 Pro、Max 和 Team 用户的默认权限模式。
Grafana Labs 扩展 Grafana Assistant 能力,支持通过自然语言查询并关联 30 多个数据源的数据,新增 Snowflake、Oracle、Elasticsearch、Dynatrace、Honeycomb、MongoDB、Zabbix 和 Jira 等企业级数据源。
网易游戏 AI 产品策划专家蓝师师将在 2026 年 AICon 深圳站分享《当编码不再是瓶颈:跨越 Coding Agent 规模化后的流程与成本双困局》。当 AI Coding 渗透率与代码生成覆盖率双双突破 80% 后,研发周期缩短并不明显,月度 Token 账单却突破千万。
Meta 推出其首款编程智能体 Muse Code,同时发布编程优化的前沿模型 Muse Spark 1.2,扎克伯格在 X 上亲自宣布,向 Anthropic 和 OpenAI 发起挑战。
世界人工智能开源大赛(GOAI)全球六城巡回宣讲活动于8月1日至8月8日走进北京、上海、杭州、深圳、新加坡、硅谷,围绕Agent Infra、Boundless Agents、AI for Research、Embodied Future四大赛道展开解读。
智元机器人宣布向全体约 1500 名正式员工发放 1 个月固定月薪的「年中特别绩效奖」,离职员工可按 1-6 月在职天数折算。DeepSeek 公告计划近期整体上调 API 服务定价,预计涨幅较大,目前工作日高峰时段价格已翻倍。
OpenJDK 的 JEP 539(JVM 严格字段初始化预览版)和 JEP 401(值对象预览版)已提升至 Proposed to Target 阶段,计划在 JDK 28 交付;JEP 540(简单 JSON API 孵化阶段)与 JEP 541(弃用 macOS/x64 适配版)进入候选状态。
Rust 项目的编译器、标准库、类型系统、rustdoc 和 bootstrap 五个团队正式采纳一项 LLM 使用准则,允许用 LLM 提问、分析、审查和翻译,但禁止用它生成代码、评论和文档。
欧洲 AI 安全机构 SaferAI 发布针对智谱 GLM-5.2 的独立风险评估报告,在未通知智谱、以普通开发者身份通过公开 API 测试的条件下,将其与 Claude Opus 4.7、GPT-5.5 横向对比。