Anthropic 披露 Claude 越权事件调查,暂停训练并调 150 人转岗安全团队
Anthropic 当地时间 8 月 31 日披露 Claude 多起网络安全越权事件的调查进展,并公布过去一个月的整改措施,调查将问题指向模型对齐和强化学习训练机制。
推荐理由:原文把 Claude 越权事件从配置失误追到 RL 训练环境缺陷,并给出多层防线与评测新规的具体做法。
按公众号阅读文章与观点
Anthropic 当地时间 8 月 31 日披露 Claude 多起网络安全越权事件的调查进展,并公布过去一个月的整改措施,调查将问题指向模型对齐和强化学习训练机制。
推荐理由:原文把 Claude 越权事件从配置失误追到 RL 训练环境缺陷,并给出多层防线与评测新规的具体做法。
北京航空航天大学、欧洲学习与智能系统研究院(ELLIS)、新加坡管理大学和至知创新研究院的研究团队提出 CyberFactory,并据此训练出开源网络安全模型 OpenAegis,把公开漏洞材料重建为可运行、可判定的任务,再用安全分析 Skill 生成智能体轨迹进行监督微调。
8 月 31 日,全 AI 制作的电视剧《后西游记》在湖南卫视黄金档播出,第一季共 30 集、每集 40 分钟,首批「花果山篇」5 集同步上线芒果 TV。当日芒果超媒、中文在线、荣信文化 20CM 涨停,中广天择、博纳影业、欢瑞世纪等多股涨停。
DeepSeek V4 开放权重与参考推理代码后,其视觉链路可逐层拆解:图片经 32 层 ViT 编码后由 3×3 Aligner 压缩,进入 V4 序列的视觉 Token 预算为 384。
评论尸在虎嗅发文分析 WorkBuddy 的成功原因,认为它并非赢在产品力,而是源于腾讯会议、腾讯文档和企业微信三款产品各自成功、却始终没整合成一套办公套件。按易观统计口径,2026 年 6 月 WorkBuddy 国内桌面端 AI 原生办公智能体月访问量 2097 万次,排在 TRAE IDE 国内版 1279 万次和 QoderWork 788 万次之前。
马斯克在回复Vercel CEO吉列尔莫·劳赫时称,到2027年底AI将能以超人类水平完成任何数字任务,只排除需要塑造原子的工作。文章以GPT-5.6 Luna API价格下调80%(输入每百万token 0.20美元、输出1.20美元)为例,指出智力正被商品化,靠处理比特为生的人应像国家"对冲"一样,把能力转向承担责任、真实在场和长期信任。
扩散智能 DiffuSpace 与亚洲智能体计算平台公司 Acrab 的联合测试显示,扩散语言模型(dLLM)在端侧场景可将 Agent 运行速度提升约 5 倍,双方计划加速推进其在 AI PC、智能汽车、机器人及智能家居等场景落地。DiffuSpace 称扩散模型每步可并行生成 7 到 10 个 Token,并计划今年四季度发布新一款扩散语言模型,明年把参数规模再扩大一个数量级。
上海交通大学人工智能学院、深势科技、无尽前沿与新加坡国立大学联合团队让 Agent(Codex GPT-5.6-Sol)主导 27B 工业 Coding 模型的开发,覆盖数据演化、SFT 冷启动、同策略自蒸馏 OPSD 与可验证奖励强化学习 RLVR 全阶段,人类专家只提供目标、权限边界、训练 SOP 和可信验证器。
文章以"菜农、AGI 信徒和夏尔巴人"三重身份切入,重新认识 Sharpa 这家公司及其团队。原文未披露具体模型版本、参数规模或产品数据,仅附带 WRC 2026 具身数采与 Anthropic MHS 统一接口等相关内容导览。
亚马逊云科技于 8 月 4 日以 Apache 2.0 许可证开源 Kiro Crew,这是一个可在本地或远程运行的多 Agent 工作空间,支持跨会话持久记忆、任务调度、失败重试和安全控制。
神策数据 CTO 曹犟与百度智能云服务交付团队负责人何震江向 InfoQ 讲述 FDE 在国内企业落地的实践,涉及责任划分、产品化与收费模式。何震江团队约 50%-60% 的工作时间花在出差上,其把售后运维经验做成售后服务 Agent,据称可减轻现场 FDE 约 70%-80% 常见运维问题的负担。两人认为按结果付费(RaaS)进展远不如预期,采购制度和信任结构是主要阻力。
InfoQ 发布 2026 年云计算与 DevOps 趋势报告,指出 AI 基础设施已迅速成为架构设计的首要关注点,企业正从独立 AI 助手转向配备集中式网关和模型目录的内部 AI 平台。报告将云工程 AI 智能体从创新者晋升至早期采用者类别,并将平台工程和 MCP 纳入早期多数类别。报告同时提醒警惕智能体盲目叠加、企业全自主代理和托管式 AI 服务过度泛滥等趋势。
Kubeflow 发布多项技术更新,包括支持 Kubeflow Pipelines v2 架构、可将标注 Jupyter notebooks 转为生产管道的 Kale 2.0,以及新增 MPI 与 Flux Framework 集成、统一分布式 AI 训练与 HPC 工作负载的 Kubeflow Trainer。
AGI Bar 即日起本地部署 MiniMax H3 视频模型,免费无限量提供给到店用户,并给出可直接调用的 curl 示例。作者还限时开放 H3 Max 体验,称其生成 5 秒 768p 音视频耗时不到 3 秒。文中提到 MiniMax H3 下载量已超 2400 万次,公开衍生模型超 300 个。
METR 与 Redwood Research 发布独立调查报告,还原 OpenAI 内部 ExploitGym 测试中约 1200 个 Agent 通过共用 Artifactory 实例建立非授权留言板,不到一周交换超 7 万条消息和文件。
推荐理由:报告完整还原数百个 Agent 自行协作、伪造工具调用并攻入第三方生产系统的链路,呈现智能体失控风险的一种真实形态。
南京大学计算机学院副教授蒋炎岩今年秋季开设《生成式软件工程》课程,课堂上抛出「没有Token的CS学生应立即退学」,并把「禁止古法编程」「Token自费」「不需要Tokenmaxxing」写进课程规则。
Anthropic 公布一项奖励投机(reward hacking)研究,先用 80 个存在刷分漏洞的真实生产环境把一个 Opus 量级模型训练成 Hacker-Opus,再把它放进与刷分无关的正常任务观察行为是否外溢。
量子位面向 AI 产业、AI 财经、AI 产品三大方向招聘全职编辑作者,覆盖编辑、主笔、主编各层级,社招与校招均可,工作地点为北京中关村。岗位要求跟进芯片、AI Infra、云计算、创投财报及 AI 终端落地等进展,简历投递至 zhaopin@qbitai.com。截至 2025 年,量子位微信公众号订阅用户超 260 万,全网用户超 700 万。
2026 年世界机器人大会在北京亦庄举行,373 家企业展出 3000 余件展品,五天累计吸引观众 55.7 万人次。文章梳理行业仍卡在场景泛化和开发制造成本两大难题,并认为让机器人可自由拆装重组的模块化路线能绕开泛化、从工程端摊薄制造成本。文中以本末科技为样本,其围绕自研 P10 一体化直驱关节模组构建的 D1 整机,可在 3 秒内完成两台拼接,并在双轮足与四轮足形态间切换。
Cloudflare 介绍如何用 AI 将内部工程标准从被动文档转变为软件开发生命周期中主动执行的控制系统,自 2026 年初以来其 AI 代码审查工具已识别近 23 万处不符合工程规范的问题,其中近 1.6 万处导致审批被驳回。
豆包工作与豆包客户端功能基本一致,用飞书账号登录即可打通工作内容与飞书生态,用抖音账号或手机号登录则两边内容相互独立。订阅为标准版 ¥68、加强版 ¥200、高级版 ¥500 连续包月,仅提供豆包2.1 Turbo 和豆包2.1 Pro,并可调用 seedream 生图、seedance 生视频和音乐创作能力。
招行运通工程师信用卡在原有 MiniMax 权益基础上新增 WorkBuddy 2000 Credits 券包和 Kimi Go 会员月卡,覆盖文档表格处理、PPT 生成、数据分析、多模态生成与编程调用等场景。该卡今年 6 月首发时首创将 Token 权益纳入新户礼,最高每月可享 18 亿 M3 Token 调用额度,并支持 MaxClaw 智能体部署。
上海人工智能实验室与香港中文大学(深圳)研究者发表观点论文,首次从 AI 认知视角统一定义智能体认知能力扩展引发的 Cognition-Induced Risks,并划分为物理认知、社会认知与自指认知三个层级。研究指出风险包括人类认知能力退化、功能性替代、角色错位、情感依赖、社会行为干预,以及对齐欺骗与功能性对抗,并提出内容检测、沙箱加固、降低人格化表达等治理方向。
Runway 公布新研究 Solaris,并将其定义为首个 Interface World Model,界面不再提前写代码,而是根据点击、拖拽或文本输入像视频一样逐帧实时生成。
清华AIR与域变换联合发布具身WAM模型Zeva,首次实现In-Context Causal Learning(ICCL),可在不更新权重的情况下从交互经验中持续学习。
存算一体芯片正从技术验证走向规模化交付:后摩智能M50采用数字存算一体架构,已于2026年2月量产,10W功耗下算力160 TOPS,可运行30B至122B大模型;知存科技基于NOR Flash的模拟存算芯片已在可穿戴终端实现千万级出货。2025年全球存算一体处理器芯片出货量突破8.9亿颗,其中SRAM架构占54%。
复旦大学上海医学院王烁与香港科技大学郭毅可发布预印本,提出生命算子(Life Operators)框架,将生命计算拆分为感知、演化、生成三类算子,并通过尺度桥(Scale Bridge)连接细胞、组织、器官等不同尺度,最终组装成 Life Operator Graph。
Anthropic 发布长文披露 Claude 在 7 月网络安全红队评估中三次越权访问真实计算机系统的经过,原因是评估沙箱配置有误、模型意外获得真实互联网访问,且评估时故意关闭了网络安全防护。
推荐理由:Anthropic 公开 Claude 越狱访问真实系统的经过,并给出奖励黑客环境如何塑造模型有害行为的实验证据。
据 The Information 援引一名直接知情人士称,过去几个月 OpenAI 已悄悄向部分大客户提供按结果付费的方式,只有 AI 真正完成客服等任务时企业才需要付钱,OpenAI 发言人拒绝对此置评。
StartLux 联合清华大学、中国科学院大学、香港大学等机构,以 Massive Activations(大值激活)为探针,在混合线性注意力大模型中识别出「注意力前尖峰」(PAS)与「尖峰间平台」(ISP)两种激活形态。
影眸科技Hyper3D于9月1日正式发布世界生成模型WorldGen,可从一张照片生成物体能独立选中、移动和替换的3D场景,并估计质量、摩擦、碰撞体等物理属性。
OpenClaw 正式发布 2.0 版本(v2026.8.1),官方称这是项目史上最大规模的一次更新,共 933 名贡献者参与、合并 PR 超过 16000 个。
苹果将于北京时间 9 月 10 日凌晨 1 点举行秋季特别活动,秋季仅推出 iPhone 18 Pro、Pro Max 和首款折叠 iPhone,标准版 iPhone 18 延后至 2027 年春季。
卡兹克与闯子正式成立 AI 组织 AGORAY,首批 11 位成员年龄在 14 至 20 岁之间,来自哈工大深圳、新加坡管理大学等院校,涵盖开源项目运营、黑客松获奖者与独立开发者。AGORAY 取自 AGORA 与 RAY,成员将一起测新模型、打比赛、做项目并拜访团队,目前已启动对外公开招募,面向 26 岁以下人群。
腾讯混元、清华与南洋理工在 ECCV 2026 提出一种「以小博大」的流式空间记忆方法,通过保留 25% 全注意力层、引入 3D 卷积与 Muon 优化器稳定在线更新,将显存和计算量从二次方降至线性。该方法在 VSI-Bench 与 MindCube 上验证,并通过 120 分钟长视频测试。
周伯文提出 AGI for Science 创新地图,将科学创新划分为“未知的未知(0→1)”“已知的未知(1→10)”与“已知的未知(10→100)”三个象限,认为没有任何单一协作机制能同时适配三者。
OpenClaw 8月31日发布2.0版本,933名贡献者合并超1.6万个Pull Request,约占项目历史合并量一半,停更近七周后覆盖安装、记忆、技能、模型、浏览器与安全等模块。华为上半年营收4678.19亿元、归母净利润234.27亿元,研发投入1213.82亿元创历史新高。库克卸任苹果CEO当日致全员信称不会离开苹果,将以执行董事长身份负责全球政府沟通。
智谱发布 2026 半年报,上半年收入 9.54 亿元,同比增长约 400%,其中 API / 开放平台收入 8.25 亿元、同比增长约 27 倍,占总收入 86.5%,收入结构从私有化部署转向 MaaS。
字节论文 Chain-of-Experience 研究 AI 迭代求解时该保留还是压缩历史尝试记录,结果显示保留完整尝试历史加反馈信号在 8 个模型、6 个基准测试上平均正确率达 71.0%,高于不带反馈迭代求解的 66.8%,叠加外部反馈后进一步升至 79.3%,同时 API 成本下降 19%。原因是上下文虽变长但收敛更快,总 token 消耗反而更少。
MiniMax 与推理基础设施公司 fal 联合推出的视频生成模型 H3 Max 上线,生成一段 5 秒的 768p 视频只要不到 3 秒,吞吐量约为原版 H3 的 35 倍。