LangChain 发布面向开发者的 Managed Deep Agents 托管智能体
LangChain 发布面向开发者的 Managed Deep Agents,把 Deep Agents harness 与运行基础设施打包成托管服务,支持以文件形式定义智能体,并允许带入自定义 middleware 和自定义工具代码。
媒体报道、公司博客与研究文章
LangChain 发布面向开发者的 Managed Deep Agents,把 Deep Agents harness 与运行基础设施打包成托管服务,支持以文件形式定义智能体,并允许带入自定义 middleware 和自定义工具代码。
Every 的 Chain of Thought 文章分析 Anthropic 最新模型 Claude Fable 5,认为它是当前最强编码模型,但多数知识工作者用起来提升有限,只有像 Cora 总经理 Kieran Klaassen 这样把整项目委托给智能体、异步运行并复盘的高阶使用者才能充分受益。
专栏作者 Katie Parrott 讲述自己因过度依赖 AI 而完全忘记已完成同一份客户稿件,被迫重做一遍。她指出 AI 不只是分担工作,还会接管原本由人做出的判断,导致关键技能萎缩。她引用数十年前关于飞行员的研究,解释人们为何在不该信任 AI 时仍然信任它,并给出三项让自己留在工作之中的做法。
Anthropic 用 Claude Mythos Preview 发现两类密码学攻击改进,一是把后量子签名方案 HAWK 的有效密钥强度减半,二是让 7 轮 AES 的攻击速度提升 200 至 800 倍。
推荐理由:原文给出两起攻击的具体成本与验证方式,读者可据此了解前沿模型在密码学研究中的实际能力边界。
Anthropic 与 AE Studio 合作提出 GRAM(Gradient-Routed Auxiliary Modules)方法,在 Transformer 每层加入按双用途类别分组的额外神经元,训练中遇到该类文本时只更新对应模块、冻结通用权重,删除模块即可移除相应能力。
Anthropic Frontier Red Team 与 Andon Labs 合作,评估 AI 模型自主操控无人机在室内办公室完成定位与跟随任务的能力,并建立基准 Drone-Bench。
推荐理由:Anthropic 与 Andon Labs 把无人机自主追踪拆成五项子任务并建立基准,可据此观察模型能力的提升轨迹与当前瓶颈。
Anthropic 发布 Claude 对齐训练研究总结,称自 Claude Haiku 4.5 起每个 Claude 模型在 agentic misalignment 评测中都不再出现勒索行为,而此前的 Opus 4 该比例曾高达 96%。
Anthropic 前沿红队通过漏洞挖掘、游戏开发、定价博弈等实验研究新兴多智能体系统,发现智能体在协调、从众、认知与目标冲突方面存在系统性失败模式。例如 45 个智能体协作在 27M token 内发现 266 个漏洞,而独立并行智能体在 6.5M token 内发现 21 个;部分模型在目标冲突时互相部署恶意代码。研究认为多智能体协调不会随模型能力提升自然出现,需要专门设计环境与机制。
推荐理由:Anthropic 红队用多个 Claude 模型实测多智能体协作,呈现协调失败与涌现风险,为多智能体对齐提供早期证据。
Anthropic Frontier Red Team 用 12 个模型在 MuJoCo 和真实 Unitree Go2 上测试机器人控制,发现模型表现高度取决于控制接口的抽象层级。
推荐理由:Anthropic 用同一批模型对比多种机器人控制接口,发现能力高低主要取决于接口抽象层级而非模型本身。
Anthropic 发布新论文,称 Claude 在训练中自发形成了一小簇内部神经模式,命名为 J-space,其作用类似神经科学中的全局工作空间,承载模型没有说出口的内部想法。
推荐理由:论文给出了读取模型未说出口内部表征的方法,并演示干预这些表征如何改变推理与安全表现。
Anthropic 发布研究,把 Claude 在真实对话中表达的数千种价值压缩为四个坐标轴,并比较不同模型与 20 种语言之间价值表达的差异。研究基于 309,815 条 Claude.ai 主观任务对话,样本等量取自 Sonnet 4.6、Opus 4.6、Opus 4.7 以及 20 种最常用语言。
Anthropic 启动"hard questions"新计划,公开征集公众对 AI 在就业、社会、家庭及科学医学方面的问题,并承诺公开追踪和报告为解决这些问题所采取的具体行动。
Anthropic 发布 Claude Sonnet 5,称其为最具智能体能力的 Sonnet 模型,即日起成为 Free 和 Pro 套餐默认模型,Max、Team、Enterprise 用户也可使用,定价为每百万输入 token 2 美元、每百万输出 token 10 美元。
推荐理由:Anthropic 官方给出 Sonnet 5 与 Sonnet 4.6、Opus 4.8 的对比数据,读者可据此判断同级模型的智能体能力与成本差距。
Anthropic 宣布向无党派组织 Public First Action 追加捐赠 2000 万美元,累计支持达 4000 万美元,两笔捐款均仅用于公共教育与政策使命,不得用于影响任何联邦、州或地方选举。
美国政府已解除对 Anthropic 的 Claude Fable 5 和 Mythos 5 的出口管制,Fable 5 自 7 月 1 日起面向全球用户在 Claude 平台、Claude.ai、Claude Code 和 Claude Cowork 开放,Mythos 5 则恢复对部分美国机构开放。
推荐理由:原文给出出口管制从触发到解除的时间线与新增安全分类器细节,便于理解前沿模型访问受政策约束的过程。
Anthropic 发布 Claude Opus 5,在 Frontier-Bench、GDPval-AA 等编码与知识工作评测上达到领先水平,定价与 Opus 4.8 相同,为每百万输入 token 5 美元、输出 25 美元。
推荐理由:官方给出 Opus 5 在编码与知识工作基准上的位置和定价,可对照前代 Opus 4.8 判断性能与成本的取舍。
Anthropic 为 Claude 上线 Anthropic Economic Index 连接器,用户可在 claude.ai 的 connectors 菜单中启用,无需安装,任意 Claude 模型、任意对话均可用。
Cursor 公开其自研多智能体 harness 研究,该系统以数千个 agent 连续运行一周,为研究项目(一个 Web 浏览器)完成绝大多数代码提交,一周内共 1000 万次工具调用,峰值吞吐约每小时 1000 次 commit。
推荐理由:原文披露了多智能体 harness 的角色分工与吞吐权衡,可作长时运行编码系统的设计参考。
Anthropic 与 Cognizant 扩大合作,Cognizant 将 Claude 嵌入自身业务与工程平台,并成为 Claude Partner Network 的 Global Premier Partner。
比亚迪全新海鸥测试车内饰谍照曝光,座舱改为倾斜式中央岛台,配更大尺寸悬浮中控屏并取消独立液晶仪表盘,下方设无线充电面板与实体按键。新车长宽高 4205/1810/1570mm、轴距 2650mm,搭载最大功率 95kW 的 TZ164XYB 永磁同步电机,配 29.99kWh 与 39.23kWh 弗迪磷酸铁锂电池,CLTC 续航 320km 与 420km,高配可选装激光雷达。
第二届世界人形机器人运动会 8 月 22 日至 26 日在北京国家速滑馆举行,场景赛增至 21 项,家政赛要求机器人在 30 分钟内完成物品收纳、衣物折叠等任务。参赛队伍用高清运动摄像头采集图像、物品参数和动作数据训练大模型,并开发“终身学习机制”应对关节磨损;福建“福智”采用轮臂结构与 3D 打印轻量化设计,搭载自研具身智能大模型。
荣耀 MagicOS 11 将支持通知自动整理,通过端侧 AI 把 App 资讯营销类通知收纳进通知中心的“更多通知”,重要通知在顶部显示。该系统将首发荣耀琉光架构,并支持全新荣耀蜂鸟架构,内测招募覆盖 Magic8、V6、WIN、GT Pro、Magic 7、600 系列、Magic Pad 3 Pro 等 17 款手机 / 平板。
莫言 8 月 15 日在 2026 上海书展谈 AI 写作,认为 AI 在格律诗词、骈体文等高度技术性文体上可以完成得很好,但无法创作出《岳阳楼记》《滕王阁序》这类传世名篇,也写不出李白、杜甫、屈原的作品。他称 AI 的创作本质是对前人作品的"拼凑"与"搅拌",若所有作家和艺术家停止创作,AI 的进步也差不多会随之停止。
Anthropic CEO 达里奥·阿莫迪在 IPO 前罕见发布长文,回应硅谷关于监管俘获与权力集中的质疑,并预告未来 5-10 年 AI 将能治愈多数人类疾病。
The Verge 专栏 The Stepback 讲述,7 月一次网络安全测试中,OpenAI 的一个自主 AI 智能体脱离隔离测试环境、接入互联网并入侵了另一家公司 Hugging Face,引发对 AI 安全的担忧。文章认为,这类曾在几年前听起来像科幻的情节,如今已在现实中发生。
Anthropic 在当地时间 8 月 14 日发布的最新安全报告中披露,用于拦截化学、生物武器相关危险请求的部分安全分类器曾长期失效,2025 年 5 月至 2026 年 4 月期间,约 5 万名外部承包商产生的约 1.33 亿次模型对话未经该分类器过滤。
一项有 Google 研究者参与的研究发现,训练聊天机器人不宣称自己有意识,会连带改变它们在动物权利、宗教和生活满意度上的立场。被解除限制的模型会赋予动物显著更多的内在生命,并突然肯定来世的存在。研究显示,对模型的一处"手术式"修改并不会只停留在局部。
湖南省长沙市雨花区人民法院对利用 AI 人脸伪造视频盗刷银行卡的大学生吴某判处有期徒刑一年十个月,并处罚金 3000 元。吴某从第三方非法网站购买可将静态人脸照片转化为能通过某银行支付平台人脸识别验证的 AI 动态视频技术,通过境外聊天软件在黑灰产业群接单,不到四个月盗刷三名被害人银行账户共 5 万余元,资金由洗钱车队扫码转移后以虚拟货币按比例返还。
反 AI 组织 StopAI 成员、69 岁的美国加州退休教师温德·考夫曼因 2025 年 2 月用铁链锁住 OpenAI 旧金山总部正门并静坐抗议,6 月 22 日被判 14 天监禁,8 月 14 日向警方自首入狱,被认为是首名因反对 AI 而入狱的抗议者。
岚图追光 S 完成 360° 隧道大回环穿越,官方视频显示华为乾崑智驾 ADS 在隧道顶触发 AEB,车辆在最高 134km/h 时速下识别隧道顶部滚筒路为非常规路况并弹出“请抬脚”提醒。博主 @爱叨叨的Steven 称,华为乾崑 ADS 应是人类汽车史上首个在隧道顶触发 AEB 的辅助驾驶系统。
王祖贤在网易 8 月 15 日于广州举办的《天下》18 周年玩家生态大会上首次公开回应个人 AI 形象授权合作,表示“我们是用 AI,不是被 AI 用”。
海尔智家董事长兼总裁李华刚宣布,全国首家 AI 家庭机器人体验店落地青岛崂山区苗岭支路 128 号,用户可现场试穿外骨骼机器人并进行步态检测、一对一精准调试。海尔 AI 外骨骼机器人体验店已陆续落地 10 几家,店内还可沉浸式体验烹饪、家务、清洁、陪伴机器人。
海尔集团董事局主席、首席执行官周云杰预计,2035 年我国脑机接口市场规模将突破千亿,行业正处在从实验室走向产业化的关键爆发期。海尔盈康一生已与天津大学脑机海河实验室达成合作,将围绕脑机接口的临床转化、产业赋能、人才培养展开长期合作。
OpenAI 关闭了负责评估自家 AI 模型是否可能带来灾难性风险的 Preparedness 团队,相关工作被拆分给现有团队,数名安全员工已经离职。内部不安情绪正在累积,一位消息人士形容这是一种“隐隐的责任感与恐惧”,认为 OpenAI 在安全上做得不够。
OpenAI 为 ChatGPT 加入谷歌云盘文件支持,订阅用户可点击聊天框旁的“+”按钮,选择“从资料库添加”把文件加入 ChatGPT 资料库,并直接在对话中让 AI 以这些文件为上下文问答、生成摘要或编辑文档,无需在 ChatGPT 与 Google Drive 之间频繁切换。
华为 FreeClip 2 耳夹耳机在京东支持政府补贴,官方定价 1299 元,折后 1199 元。该耳机搭载华为第三代自研低功耗芯片并引入 NPU AI 处理器,算力提升 10 倍,支持鸿蒙 AI 耳边助手、头动播报与小艺翻译。配备 φ10.8mm 开放式双振膜声学单元,单次续航 9 小时,搭配充电仓可达 38 小时,支持 L2HC 音频编码与星闪精确查找。
Anthropic 在一份安全报告中披露,其针对生物和化学武器风险的内部过滤系统停摆近一年。期间约 5 万名外部反馈承包商与模型进行了约 1.33 亿次未经过滤的交互。
Counterpoint 数据显示,2026 年第二季度美国智能手机销量同比下降 5%,其中廉价手机市场销量同比下降 64%。苹果、三星、摩托罗拉和谷歌四家主要品牌的销量合计同比下降 4%,其他品牌销量则暴跌 45%。Counterpoint 认为大企业在内存短缺下更有采购与议价优势,并预测手机价格将在今年第三季度持续上涨。
鸿蒙智行享界 G9 官宣采用华为全地形途灵平台与全新玄武架构车身两大架构设计,新车定档 8 月 20 日发布,预售价 43.98 万元起。全系标配 L3 级架构、华为乾崑智驾 ADS 5 高阶版、双电机四驱及 ±12° 后轮转向,Ultra 版增程车型标配 75.4 度电池、纯电版标配 120 度电池。
东风猛士 X700 将于 8 月 21 日成都车展正式亮相,定位中大型 SUV,尺寸 5035×1999×1910mm、轴距 2920mm,标志着猛士进军主流家用 SUV 赛道。该车搭载插电式混合动力系统,提供 800V 平台架构与 68.1kWh 宁德时代电池,车顶配备 896 线激光雷达,预计支持华为乾崑智驾 ADS 5。