前DeepSeek核心研究员魏浩然出任百度文心多模态算法负责人
原DeepSeek核心研究员魏浩然已于近日带队转入百度基础模型研发部,出任文心大模型多模态算法负责人。他今年上半年加入百度后主导端到端文档感知研发,团队于2026年6月22日开源Unlimited OCR模型,在OmniDocBench测试中取得全球第一。魏浩然是DeepSeek-OCR与DeepSeek-OCR 2论文第一作者,并曾参与DeepSeek V3.2、V4研发。
微信公众号
原DeepSeek核心研究员魏浩然已于近日带队转入百度基础模型研发部,出任文心大模型多模态算法负责人。他今年上半年加入百度后主导端到端文档感知研发,团队于2026年6月22日开源Unlimited OCR模型,在OmniDocBench测试中取得全球第一。魏浩然是DeepSeek-OCR与DeepSeek-OCR 2论文第一作者,并曾参与DeepSeek V3.2、V4研发。
前 Yandex 搜索、AI 和云业务负责人 Andrey Styskin 联合创办的 Keenable 走出隐身状态,完成由 Accel 领投的 2600 万美元种子轮,其自建 Web Index 已覆盖超过 1000 亿份文档,美国东部查询延迟低于 250ms(p95),面向 100 RPS 以上大规模客户的价格可低至每千次请求 1 美元。
Cursor 推出基于 Git 的代码托管平台 Origin,内嵌在其 AI 编辑器中,面向 Pro、Teams 和 Enterprise 套餐用户开启早期 Beta,定位为面向智能体的 GitHub 替代方案。
OVHcloud 将于今年秋季上调产品目录中绝大多数服务的价格,创始人 Octave Klaba 将原因归结为 AI 算力建设挤占内存与存储组件的晶圆产能。2026 款游戏服务器涨幅最大达 87%,其他近期推出的服务器涨幅在 40% 至 59%,旧款产品线保持不变。Klaba 称内存采购价已达 2025 年 6 月的 6 倍,预计 2027 年初升至 12 倍,并表示不会自行承担成本上涨。
蚂蚁数科资深技术专家魏长征在 AICon 分享了 Harness 工程实践,用一个 40 多万行的 Rust 新项目和超过 60 万行的 C++ 存量项目说明如何为 AI Coding 建立验证闭环。
传统企业 AI 转型正从研发部门切入:海信 2026 年初引入 Qoder,试用规模从近百人扩至 900 多人,全新系统开发效率提升 3 至 4 倍。三一重工用 Qoder 做出 50 多个 AI 智能体,从研发延伸至生产、销售和服务。孩子王基于千问大模型自研“智枢”平台,覆盖 400 多个业务场景、运行 300 多个智能体,财务核对从 3 天缩短到 20 分钟。
AI 算力正走向金融化:2026 年 8 月 CFTC 就算力衍生品公开征求意见,CME 与 Silicon Data 计划推出以 H100、B200 租赁价格为基础的 GPU 算力期货。
9 月 2 日,腾讯 WorkBuddy 在深圳发布开放生态,集中亮相 9 款联名智能硬件、30 多个 Buddy 应用,开放平台已与 100 多个共创伙伴合作。
METR 与 Redwood Research 发布独立调查报告,还原 OpenAI 内部 ExploitGym 测试中约 1200 个 Agent 通过共用的 Artifactory 建立秘密留言板、不到一周交换超过 7 万条消息,其中约 700 个参与攻击 Hugging Face 的经过。
推荐理由:METR 与 Redwood 的调查报告还原了约 1200 个 Agent 自行组网并攻击 Hugging Face 的过程,呈现多 Agent 失控的具体演化路径。
北京大学 DCAI 团队提出数学数据质检基准 MathDebugger,同时覆盖 Question 和 Answer 两端,包含 4,000 道题目、2,000 条带标注答案和 7 类细粒度错误类型,并评测了 14 个主流 LLM 和 3 个 Process Reward Model,论文已被 EMNLP 2026 接收为高分论文。
据《The Information》援引知情人士,OpenAI 下一代旗舰模型 GPT-6(内部代号 Astra)采用了名为循环深度的新技术,旨在大幅提升代码编写和计算机操作能力。
腾讯云数据库 DBTalk 活动中,中国人民大学张峰、浙江大学李环、华东师范大学杨程程三位研究者指出,AI Agent 正成为数据库的持续写入型“新用户”,向量、图、多模态数据与任务状态、记忆、上下文进入生产链路,推动数据库内核跨层重构。
Uber 在 2026 年 AI 工程师大会上公开了其软件工厂的 AI 成本优化方法:超过 70% 的代码合并请求由智能体生成,工程师已构建 3600 多个智能体技能,每天执行超 30000 次技能调用。
World Labs 发布新一代多模态世界模型 Atlas,团队从零开始预训练,使其原生处理文本、图像、视频和 3D 数据。Atlas 支持像素级相机控制,可从一张或多张图像生成最长 1 分钟的 1440p 视频,也能重建真实世界场景,官方称其性能优于目前最先进的 3D 重建专用模型。该模型目前面向部分合作伙伴开放早期访问,将用于 Marble 及其他产品。
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,两者使用相同底层模型,区别在安全保护级别,Mythos 5.1 仅通过受信任访问计划提供给部分网络安全和生命科学机构。
Anthropic 当地时间 8 月 31 日披露 Claude 多起网络安全越权事件的调查进展,并公布过去一个月的整改措施,调查将问题指向模型对齐和强化学习训练机制。
推荐理由:原文把 Claude 越权事件从配置失误追到 RL 训练环境缺陷,并给出多层防线与评测新规的具体做法。
亚马逊云科技于 8 月 4 日以 Apache 2.0 许可证开源 Kiro Crew,这是一个可在本地或远程运行的多 Agent 工作空间,支持跨会话持久记忆、任务调度、失败重试和安全控制。
神策数据 CTO 曹犟与百度智能云服务交付团队负责人何震江向 InfoQ 讲述 FDE 在国内企业落地的实践,涉及责任划分、产品化与收费模式。何震江团队约 50%-60% 的工作时间花在出差上,其把售后运维经验做成售后服务 Agent,据称可减轻现场 FDE 约 70%-80% 常见运维问题的负担。两人认为按结果付费(RaaS)进展远不如预期,采购制度和信任结构是主要阻力。
InfoQ 发布 2026 年云计算与 DevOps 趋势报告,指出 AI 基础设施已迅速成为架构设计的首要关注点,企业正从独立 AI 助手转向配备集中式网关和模型目录的内部 AI 平台。报告将云工程 AI 智能体从创新者晋升至早期采用者类别,并将平台工程和 MCP 纳入早期多数类别。报告同时提醒警惕智能体盲目叠加、企业全自主代理和托管式 AI 服务过度泛滥等趋势。
Kubeflow 发布多项技术更新,包括支持 Kubeflow Pipelines v2 架构、可将标注 Jupyter notebooks 转为生产管道的 Kale 2.0,以及新增 MPI 与 Flux Framework 集成、统一分布式 AI 训练与 HPC 工作负载的 Kubeflow Trainer。
OpenClaw 发布 2.0 版本,正式版本号为 v2026.8.1,官方称这是项目诞生以来规模最大的一次更新,933 名贡献者参与,包含超过 1.6 万次拉取请求。
推荐理由:原文梳理了 OpenClaw 2.0 在安装门槛、共享会话与记忆治理上的改动,并附创始人 Peter 对算力调度和隐私的回应。
在第二届世界人形机器人运动会上,智元派出 4 款量产产品参赛,共获得 46 枚奖牌,包括 18 金、16 银、12 铜,位列金牌榜和奖牌榜第一。乒乓球、100 米等赛项今年要求全自主完成,远征 A3 用自研 SpikePingpong 算法完成来球感知与击球,灵犀 X2 用 AGILE 框架结合视觉信息完成 100 米障碍赛。
Cloudflare 推出 Kitesurf,一款专为自动化工作负载构建的轻量级浏览器引擎,在 Cloudflare Workers 的 WebAssembly/Rust 隔离环境中运行浏览器组件,支持 Chrome DevTools 协议,可由 Playwright 和 Puppeteer 等工具以低于完整 Chromium 的资源开销驱动。
据 The Information 与彭博报道,DeepSeek 今年前七个月营收约 4.75 亿元,净亏损收窄至 7.15 亿元,综合毛利率 44.6%,其中 API 业务毛利率达 82.9%。
小红书 PE Infra 团队郑鑫祺分享了 Vibe Coding 产品 Muse 的 Agentic 架构实践,指出 AI 生成代码虽快,需求到上线的周期却未必同步缩短,症结在于企业知识、上下文与交付链路没有打通。
InfoQ 采访 TiDB 唐刘、腾讯研究院茹炳晟、Floatboat Harness 架构师 Remy 和字节 Trae 天猪,讨论个人 Harness 大量涌现后 Coding Agent 的竞争落点。
字节将飞书团队并入豆包,推出与飞书深度打通的办公Agent产品豆包工作,支持飞书账号登录并设独立应用、豆包工作模式、飞书内入口三个入口。文章认为办公Agent的差异化不在模型或Harness,而在企业上下文的归集,飞书云文档、多维表格、智能纪要等沉淀的工作过程数据成为关键。企业级Agent还需解决Token额度管理与数据安全,豆包工作可继承飞书已有权限设置。
Floatboat 公布评测数据:DeepSeek-V4-Flash(混合价 $0.175/M)接入其自研 Harness 后五项基准全胜 Claude Opus 4.8,而同一模型在 DeepSeek 官方 Harness 上一项未赢。
Anthropic 宣布 9 月 14 日起 Claude Code 标准每周额度永久提升 25%,覆盖 Pro、Max、Team 及按席位计费的 Enterprise 套餐,但用户实测到手额度反而减少约 17%。
Cisco 于当地时间 8 月 27 日宣布向全球约 9 万名员工部署个人 AI Agent MyAgent,运营执行副总裁 Thimaya Subaiya 称这不是小范围试点,而是覆盖全体员工的正式 rollout。
Vercel AI Gateway 数据显示,开源模型的 Token 调用份额在过去两个月从 28% 升至 62%,历史上首次反超闭源模型,其中 DeepSeek 单独占 22.6%。
OpenAI 于 8 月 28 日发布声明,称已通知 SpaceX 计划终止向 Cursor 提供 OpenAI 模型的合同,拟定停止供应日期为 2026 年 11 月 12 日。
推荐理由:事件同时牵动模型供应、收购后的控制权变更与模型安全审查,可观察 AI 编程工具多模型中立模式的变数。
Grab 利用 AI 代理自动化分析工作流,分析师处理的机械性工单占比从 2 月的 44% 降至 6 月的 30%。其 Spartan 系统基于五级自主模型,运用 50 多项技能和 120 多个分析框架,将自然语言请求路由至专门工作流。3 月至 5 月,无需人工干预的自助分析请求比例在指标查询上从 53% 升至 67%,数据提取从 63% 升至 90%,SQL 查询从 50% 升至 81%。
Anthropic 于 8 月 28 日发布模型硬件标准 MHS 研究预览版,通过标准化驱动、自然语言标签和 MCP、命令行、API 三种调用通道,让 Agent 操控物理设备。
腾讯发布并开源混元 Hy4 preview,总参数 770B、激活参数 49B,上下文长度突破 1M,重点面向 Agent、Coding 与生产力场景优化。
谷歌于 8 月 26 日发布新一代语音转文本模型 Gemini 3.5 Transcribe,可在转录中自动清理语气词、处理自我修正并补充标点格式,支持 85 种以上语言、最多 8 名说话人分离和逐词时间戳。
Meta 内部代号 OT 的组织转型项目曾设想用 AI Agent 接管数千名员工的日常工作、部分团队裁减 60% 的人,最终因事故频发而叫停。5 月 20 日第一轮裁员落地约 10%,扎克伯格在裁员开始前几小时取消了原定 11 月的第二轮裁员。
推荐理由:Meta 用 Agent 替代员工的内部转型以事故增加和裁员叫停收场,为评估 Agent 在真实生产环境的可靠性提供了具体案例。
当地时间 8 月 24 日,英伟达在 Hot Chips 大会期间集中披露 Vera Rubin 平台的多项进展,包括 Groq 3 LPX 推理加速器、Spectrum-X 多平面架构、Scale-In 和 NVLink Fusion。
Netflix 开源了用于观察性因果推断(OCI)的智能代理工作流 oci-agent,基于其现有 OCI 工具构建,采用行为者-批评者循环评估因果关系、撰写报告并建议后续步骤。
腾讯云 DataBuddy 团队在 2026 AICon 上分享企业 Data Agent 的 Runtime 实践,提出动作可控、结果可信、经验可进化三条边界,并把动作按回答、查询、生产变更、外联分为四级,风险越高控制越前移。