Anthropic 红队测试语言模型的机器人控制能力
Anthropic Frontier Red Team 用 12 个模型在 MuJoCo 和真实 Unitree Go2 上测试机器人控制,发现模型表现高度取决于控制接口的抽象层级。
推荐理由:Anthropic 用同一批模型对比多种机器人控制接口,发现能力高低主要取决于接口抽象层级而非模型本身。
Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。
当前仅显示精选新闻Anthropic Frontier Red Team 用 12 个模型在 MuJoCo 和真实 Unitree Go2 上测试机器人控制,发现模型表现高度取决于控制接口的抽象层级。
推荐理由:Anthropic 用同一批模型对比多种机器人控制接口,发现能力高低主要取决于接口抽象层级而非模型本身。
Anthropic 发布新论文,称 Claude 在训练中自发形成了一小簇内部神经模式,命名为 J-space,其作用类似神经科学中的全局工作空间,承载模型没有说出口的内部想法。
推荐理由:论文给出了读取模型未说出口内部表征的方法,并演示干预这些表征如何改变推理与安全表现。
Anthropic 发布 Claude Sonnet 5,称其为最具智能体能力的 Sonnet 模型,即日起成为 Free 和 Pro 套餐默认模型,Max、Team、Enterprise 用户也可使用,定价为每百万输入 token 2 美元、每百万输出 token 10 美元。
推荐理由:Anthropic 官方给出 Sonnet 5 与 Sonnet 4.6、Opus 4.8 的对比数据,读者可据此判断同级模型的智能体能力与成本差距。
美国政府已解除对 Anthropic 的 Claude Fable 5 和 Mythos 5 的出口管制,Fable 5 自 7 月 1 日起面向全球用户在 Claude 平台、Claude.ai、Claude Code 和 Claude Cowork 开放,Mythos 5 则恢复对部分美国机构开放。
推荐理由:原文给出出口管制从触发到解除的时间线与新增安全分类器细节,便于理解前沿模型访问受政策约束的过程。
Anthropic 发布 Claude Opus 5,在 Frontier-Bench、GDPval-AA 等编码与知识工作评测上达到领先水平,定价与 Opus 4.8 相同,为每百万输入 token 5 美元、输出 25 美元。
推荐理由:官方给出 Opus 5 在编码与知识工作基准上的位置和定价,可对照前代 Opus 4.8 判断性能与成本的取舍。
SpaceX 于 8 月 14 日完成对 Cursor 母公司 Anysphere 的收购,交易金额 600 亿美元,Cursor 股东最终获得的是 SpaceX 股票。
推荐理由:从4月算力协议到600亿美元收购,呈现AI应用公司被上游模型公司挤压后向上游靠拢的行业变化。
Z.ai 发布 GLM-5.3,目前仅在 coding plan 提供,两周内将开放权重到 Hugging Face。作者认为其与 GLM-5.2 同底座、靠大幅扩展后训练提升成绩,在部分智能体编码基准上超越 Kimi K3 甚至个别超越 Claude Fable 5 或 GPT-5.6-Sol,参数约 750B。
推荐理由:作者给出了对 GLM-5.3 成绩来源的解释框架,包括发布节奏、后训练策略和 RL 数据产业等背景,可用于理解中美前沿模型竞争的成因。
北京协和医院神经外科博士后金山木使用 OpenAI 的 GPT-5.6-Sol 模型,在约 16 小时的自主运行中证明了自 2004 年以来悬置 22 年的 Crouzeix 猜想。
推荐理由:原文给出自主证明的运行方式、提示词策略与开源材料,读者可了解智能体独立完成数学证明的一条路径。
SpaceX 于当地时间 8 月 14 日正式完成对 AI 编程初创公司 Cursor 的 600 亿美元收购,此前两个月双方已宣布达成收购协议。Cursor 通过博客表示,收购后可动用全球规模最大的 GPU 集群,用充足算力开发能力更强、运行成本更低的模型。双方在交易完成前已于 7 月推出首个联合模型 Grok 4.5,主要用于编程、金融和法律任务,两家公司称其使用成本低于其他竞争模型。
推荐理由:这笔 600 亿美元交易连同使用大规模 GPU 集群的承诺,呈现了 AI 编程赛道当前的资本与算力竞争体量。
a16z 发文分析 Cursor 被 SpaceX 以 600 亿美元全股票收购一事,称这是迄今最大的风投支持创业公司收购案。
推荐理由:a16z 以 Cursor 被 SpaceX 收购为线索,复盘其两次自我重塑,并给出迭代速度决定胜负的行业判断。
DeepSeek 在 8 月 13 日晚发布 DeepSeek Harness v0.1 开发者预览版,采用 MIT 协议开源,用 npx @deepseek-ai/dsh web 即可在本地浏览器启动。
推荐理由:文章以一夜实测加插件生态盘点,对比 Claude Code 的封闭外壳路线,呈现 harness 被开源后的竞争变化。
Anthropic 宣布未来 Claude 模型生成的文本将带水印,用于判断 Claude 参与写作的可能性,以遵守欧盟 AI Act,采用 Google DeepMind 2024 年发布的 SynthID-Text 方法,全球范围启用。
推荐理由:官方详细解释了 Claude 文本水印的实现原理、局限和检测 API 开放安排,读者可据此了解其对输出质量和合规的影响。
包括 OpenAI、Anthropic、Google、Meta、Microsoft 在内的一批公司签署了欧盟《AI 生成内容透明度行为准则》,承诺推进 AI 生成内容的标记与检测。
推荐理由:Claude 的水印方案给出了可查验的落地细节,也让人看到文本水印在改写与翻译后可能失效的边界。
Hugging Face 于 7 月 15 日至 8 月 2 日举办 ICML 2026 Open Reproductions 挑战赛,1,221 名参与者用 Claude Code、Codex、Cursor 等智能体在 19 天内发布 6,816 份 Trackio 日志,复现 2,226 篇论文,约占会议的 34%。
推荐理由:官方复盘给出了逐条声明级别的复现数据和失败案例,可迁移到用智能体做大规模论文审计的工作流。
Claude Cowork 现已作为 Chrome 侧边栏运行,能读取用户已登录的页面并执行阅读、点击、输入和填写表单等操作。技能、插件和连接器首次可在浏览器中使用,对话会保存到历史记录,会话随账号而非设备保留。任务可在浏览器标签页开始,随后在桌面端或手机上继续。
推荐理由:Claude Cowork 进入浏览器侧边栏,读者可了解技能与连接器如何让智能体直接操作用户已登录的网页。
一篇论文指出 OpenAI、Anthropic、Google 的前沿模型 API 存在设计缺陷,加密返回的完整思维链可以被转移到同系列较弱模型中复述为明文。研究者拿不到服务器端明文,只能用 API 计费的思考 Token 数做长度校验,在 120 道 Codeforces 题目上提取文本的 Token 数与源模型报告高度接近。
推荐理由:论文给出了跨模型提取隐藏思维链的完整攻击链,读者可据此了解推理模型 API 的设计缺陷与修复方向。
一篇 116 页论文披露 Anthropic、OpenAI、Google 的 API 存在架构级漏洞,同一厂商不同会话与模型之间的加密思维链块可互换,只需两次 API 调用就能提取。
推荐理由:论文披露专有模型 API 的加密思维链可跨模型提取,并给出蒸馏、隐私泄露与隐藏推理行为的多组实测证据。
Claude 在 Chrome 的侧边栏会话已改为 Claude Cowork 会话,对话会保存到历史记录,技能和连接器可在浏览器中使用,在标签页里开始的任务能在桌面端、网页端和移动端接续完成。
推荐理由:官方说明了侧边栏会话与多端打通后的连续工作方式,也交代了浏览器智能体面临的提示词注入风险和新增的动作检查。
Anthropic 宣布,尚未公开的研究版 Claude 在黎曼猜想相关研究中取得进展,把黎曼 ζ 函数临界线上零点比例的长期下界从 41.6% 提高到 67.2%。
推荐理由:未公开的研究版 Claude 以 60 个子级智能体自主推进数天,把临界线零点比例下界从 41.6% 提升到 67.2%,并公开了 Lean 验证材料。
Anthropic 宣布其尚未公开的 Claude 研究模型在黎曼猜想上取得进展,将满足该猜想的黎曼ζ函数零点比例下界从 41.6% 提高到 67.2%。该研究由约 60 个子智能体在 Claude Code 中协作完成,历时一天半,执行 2400 条 Shell 命令、写下数百个 Python 脚本,并从 arXiv 下载 54 篇论文查重。
推荐理由:读者可以看到从 650 次失败到 60 个子智能体协作的完整研究过程,以及这项数学纪录被推进的具体幅度。