跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

当前仅显示精选新闻

最新精选

第 241–260 条 · 共 500 条
8月16日周日
  1. Anthropic Newsroom85

    Anthropic 发布 Claude Sonnet 5,智能体性能接近 Opus 4.8

    Anthropic 发布 Claude Sonnet 5,称其为最具智能体能力的 Sonnet 模型,即日起成为 Free 和 Pro 套餐默认模型,Max、Team、Enterprise 用户也可使用,定价为每百万输入 token 2 美元、每百万输出 token 10 美元。

    推荐理由:Anthropic 官方给出 Sonnet 5 与 Sonnet 4.6、Opus 4.8 的对比数据,读者可据此判断同级模型的智能体能力与成本差距。

  2. Anthropic Newsroom86

    Anthropic 恢复 Claude Fable 5 与 Mythos 5 访问,出口管制已解除

    美国政府已解除对 Anthropic 的 Claude Fable 5 和 Mythos 5 的出口管制,Fable 5 自 7 月 1 日起面向全球用户在 Claude 平台、Claude.ai、Claude Code 和 Claude Cowork 开放,Mythos 5 则恢复对部分美国机构开放。

    推荐理由:原文给出出口管制从触发到解除的时间线与新增安全分类器细节,便于理解前沿模型访问受政策约束的过程。

  3. Anthropic Newsroom86

    Anthropic 发布 Claude Opus 5,编码与知识工作基准领先且定价与 Opus 4.8 持平

    Anthropic 发布 Claude Opus 5,在 Frontier-Bench、GDPval-AA 等编码与知识工作评测上达到领先水平,定价与 Opus 4.8 相同,为每百万输入 token 5 美元、输出 25 美元。

    推荐理由:官方给出 Opus 5 在编码与知识工作基准上的位置和定价,可对照前代 Opus 4.8 判断性能与成本的取舍。

8月15日周六
  1. Nathan Lambert: Interconnects71

    Nathan Lambert 解析 GLM-5.3 为何能紧跟前沿

    Z.ai 发布 GLM-5.3,目前仅在 coding plan 提供,两周内将开放权重到 Hugging Face。作者认为其与 GLM-5.2 同底座、靠大幅扩展后训练提升成绩,在部分智能体编码基准上超越 Kimi K3 甚至个别超越 Claude Fable 5 或 GPT-5.6-Sol,参数约 750B。

    推荐理由:作者给出了对 GLM-5.3 成绩来源的解释框架,包括发布节奏、后训练策略和 RL 数据产业等背景,可用于理解中美前沿模型竞争的成因。

8月14日周五
  1. IT Home80

    SpaceX 以 600 亿美元完成对 AI 编程公司 Cursor 的收购

    SpaceX 于当地时间 8 月 14 日正式完成对 AI 编程初创公司 Cursor 的 600 亿美元收购,此前两个月双方已宣布达成收购协议。Cursor 通过博客表示,收购后可动用全球规模最大的 GPU 集群,用充足算力开发能力更强、运行成本更低的模型。双方在交易完成前已于 7 月推出首个联合模型 Grok 4.5,主要用于编程、金融和法律任务,两家公司称其使用成本低于其他竞争模型。

    推荐理由:这笔 600 亿美元交易连同使用大规模 GPU 集群的承诺,呈现了 AI 编程赛道当前的资本与算力竞争体量。

  2. Anthropic Newsroom62

    Anthropic 解释 Claude 文本水印的工作原理

    Anthropic 宣布未来 Claude 模型生成的文本将带水印,用于判断 Claude 参与写作的可能性,以遵守欧盟 AI Act,采用 Google DeepMind 2024 年发布的 SynthID-Text 方法,全球范围启用。

    推荐理由:官方详细解释了 Claude 文本水印的实现原理、局限和检测 API 开放安排,读者可据此了解其对输出质量和合规的影响。

8月13日周四
  1. 机器之心 · 微信公众号77

    OpenAI、Anthropic、Google 等签署欧盟 AI 内容透明度准则,Claude 公布水印实现方案

    包括 OpenAI、Anthropic、Google、Meta、Microsoft 在内的一批公司签署了欧盟《AI 生成内容透明度行为准则》,承诺推进 AI 生成内容的标记与检测。

    推荐理由:Claude 的水印方案给出了可查验的落地细节,也让人看到文本水印在改写与翻译后可能失效的边界。

  2. Hugging Face Blog71

    Hugging Face 复盘复现 2,226 篇 ICML 2026 论文的 hackathon

    Hugging Face 于 7 月 15 日至 8 月 2 日举办 ICML 2026 Open Reproductions 挑战赛,1,221 名参与者用 Claude Code、Codex、Cursor 等智能体在 19 天内发布 6,816 份 Trackio 日志,复现 2,226 篇论文,约占会议的 34%。

    推荐理由:官方复盘给出了逐条声明级别的复现数据和失败案例,可迁移到用智能体做大规模论文审计的工作流。

  3. Claude YouTube74

    Claude Cowork 上线 Chrome 侧边栏

    Claude Cowork 现已作为 Chrome 侧边栏运行,能读取用户已登录的页面并执行阅读、点击、输入和填写表单等操作。技能、插件和连接器首次可在浏览器中使用,对话会保存到历史记录,会话随账号而非设备保留。任务可在浏览器标签页开始,随后在桌面端或手机上继续。

    推荐理由:Claude Cowork 进入浏览器侧边栏,读者可了解技能与连接器如何让智能体直接操作用户已登录的网页。

8月12日周三
  1. 机器之心 · 微信公众号76

    论文揭示前沿模型 API 漏洞:可用弱模型提取 Claude、GPT-5.6 的隐藏思维链

    一篇论文指出 OpenAI、Anthropic、Google 的前沿模型 API 存在设计缺陷,加密返回的完整思维链可以被转移到同系列较弱模型中复述为明文。研究者拿不到服务器端明文,只能用 API 计费的思考 Token 数做长度校验,在 120 道 Codeforces 题目上提取文本的 Token 数与源模型报告高度接近。

    推荐理由:论文给出了跨模型提取隐藏思维链的完整攻击链,读者可据此了解推理模型 API 的设计缺陷与修复方向。

  2. AGI Hunt · 微信公众号77

    116 页论文曝光前沿模型漏洞:加密思维链两次 API 调用即可提取,GPT、Claude、Gemini 均受影响

    一篇 116 页论文披露 Anthropic、OpenAI、Google 的 API 存在架构级漏洞,同一厂商不同会话与模型之间的加密思维链块可互换,只需两次 API 调用就能提取。

    推荐理由:论文披露专有模型 API 的加密思维链可跨模型提取,并给出蒸馏、隐私泄露与隐藏推理行为的多组实测证据。

  3. Claude Blog64

    Claude in Chrome 侧边栏升级为 Claude Cowork 会话

    Claude 在 Chrome 的侧边栏会话已改为 Claude Cowork 会话,对话会保存到历史记录,技能和连接器可在浏览器中使用,在标签页里开始的任务能在桌面端、网页端和移动端接续完成。

    推荐理由:官方说明了侧边栏会话与多端打通后的连续工作方式,也交代了浏览器智能体面临的提示词注入风险和新增的动作检查。

8月11日周二
  1. IT Home86

    Anthropic 称未公开研究版 Claude 将黎曼 ζ 函数零点比例下界从 41.6% 提高到 67.2%

    Anthropic 宣布,尚未公开的研究版 Claude 在黎曼猜想相关研究中取得进展,把黎曼 ζ 函数临界线上零点比例的长期下界从 41.6% 提高到 67.2%。

    推荐理由:未公开的研究版 Claude 以 60 个子级智能体自主推进数天,把临界线零点比例下界从 41.6% 提升到 67.2%,并公开了 Lean 验证材料。

  2. 硅星人Pro · 微信公众号77

    Anthropic 未公开 Claude 研究模型将黎曼猜想零点比例下界推高至 67.2%

    Anthropic 宣布其尚未公开的 Claude 研究模型在黎曼猜想上取得进展,将满足该猜想的黎曼ζ函数零点比例下界从 41.6% 提高到 67.2%。该研究由约 60 个子智能体在 Claude Code 中协作完成,历时一天半,执行 2400 条 Shell 命令、写下数百个 Python 脚本,并从 arXiv 下载 54 篇论文查重。

    推荐理由:读者可以看到从 650 次失败到 60 个子智能体协作的完整研究过程,以及这项数学纪录被推进的具体幅度。