Claude Console 旧版 Workbench 将于 8 月 17 日停用
Claude Console 中的旧版 Workbench 将于 2026 年 8 月 17 日停止访问,更新后的 Workbench 不再支持已保存的提示词、变量和 evals,用户可从横幅和组织设置中导出需保留的数据。
Claude Console 中的旧版 Workbench 将于 2026 年 8 月 17 日停止访问,更新后的 Workbench 不再支持已保存的提示词、变量和 evals,用户可从横幅和组织设置中导出需保留的数据。
Claude Fable 5、Claude Mythos 5 和 Claude Opus 4.8 现已在 Claude API、Amazon Bedrock 和 Google Cloud 上支持对话中途系统消息,且无需 beta header。此次更新修正了此前的可用性说明。
Claude Enterprise(claude.ai)组织现可通过 Admin API 管理成员,该功能面向所有 Claude Enterprise 组织开放测试版,支持列出成员、按邮箱查找、修改角色、移除成员、发送与撤回邀请、管理群组及其成员关系,以及读取自定义角色。
Arvind Narayanan 与 Akash Kapur 撰文认为模型推理在均衡状态下将陷入 Bertrand 悖论式竞争,价格趋向生成 token 的边际成本,模型层难以维持利润。
推荐理由:文章用历史案例和经济理论论证模型推理难逃商品化陷阱,实验室将靠上移价值栈构建护城河,但代价是企业锁定。
Claude Dreams 研究预览版现已支持 Claude Fable 5 和 Claude Sonnet 5。
Anthropic 在 Claude Console 中支持创建 API key 或 Admin API key 时设置有效期,可选预设时长、自定义时长或永不过期。有效期不少于 7 天的 key,Anthropic 会在到期前邮件通知创建者,已有 key 不受影响。Admin API 通过 expires_at 字段返回每个 key 的到期时间。
Jack Clark 在 Import AI 464 期中汇总多项进展:Fable 在 KernelBench-Mega 上提交了首个也是最快的 megakernel。
真格基金「此话当真」与「十字路口」串台播客在 Agent 元年第 500 天复盘:Claude 3.5 Sonnet 在第 100 天前后为 Agent 提供能力基础并带火 Manus,第 300 天 Claude Code 刷屏。节目以 GUI 退场、Headless 上位、CLI 复兴、Skills 封装、Agentic Economy 萌芽为主线,讨论为何不该再投资 GUI 思维的软件。
Anthropic 新增 agent-memory-2026-07-22 beta header,改变记忆列表接口行为:结果按服务端固定顺序返回,order_by 和 order 参数被忽略,depth 仅接受 0、1 或省略,path_prefix 必须以 / 结尾并按整段路径匹配。
Anthropic 已恢复 Claude Fable 5 和 Claude Mythos 5 的访问权限。官方表示相关说明可参见其声明,但未披露此次中断的具体原因与时长。
Anthropic 发布 Claude Sonnet 5(claude-sonnet-5),定价 $2/$10 每 MTok(2026 年 8 月 10 日起为标准价),支持 1M token 上下文窗口和 128k 最大输出,工具与平台功能与 Claude Sonnet 4.6 相同,但不含 Priority Tier。
推荐理由:原文给出迁移行为变化、定价与上下文规格,可供正在评估升级或迁移的开发者直接对照排查。
Anthropic 已移除 Claude Opus 4.6 的快速模式,请求 claude-opus-4-6 时带 speed: "fast" 不再以快速速度和溢价计费,而是按标准速度运行、按标准费率计费且不报错,响应中的 usage.speed 字段会报告实际使用的速度。要继续使用快速模式,需迁移至 Claude Opus 4.8。
Anthropic 上调 Claude API 速率限制,Claude Sonnet 和 Claude Haiku 的限额在所有用量层级上与 Claude Opus 持平,用量层级合并为 Start、Build、Scale 三档。多数组织将升至更高层级,没有组织的限额低于此前,且无需任何操作,可在 Claude Console 查看当前层级与限额。
Anthropic 已弃用 Claude Opus 4.7 的 fast mode,并将于 2026 年 7 月 24 日移除。移除后,向 claude-opus-4-7 发送 speed: "fast" 的请求将返回错误,官方建议迁移至 Claude Opus 4.8 的 fast mode。
Nathan Lambert 撰文认为 Z.ai 于 6 月 13 日向 GLM Coding Plan 用户推出、6 月 16 日以 MIT 许可开源的 GLM-5.2,是首个在编码智能体场景中真正好用的开源权重模型,社区评测显示其在 Arena 智能体榜单上是唯一能与 OpenAI 和 Anthropic 最新模型抗衡的开源模型。
推荐理由:作者以亲测和社区评测为依据,把 GLM-5.2 与 DeepSeek R1 时刻类比,并展开开源与闭源差距及监管风险的独特分析。
本期Import AI汇总:牛津、UK AISI、斯坦福等机构研究显示AI在4项实验、6923人、18978段对话中说服力稳定超过专家人类,对Save the Children的真实募款效果约为专业劝募员的近3倍。
Anthropic 在 Claude Platform 发布说明中宣布,MCP tunnels(研究预览)的管理 API 从 Admin API 的 /v1/organizations/tunnels 迁移至 Claude API 的 /v1/tunnels。
针对华盛顿近期签署 AI 模型审查行政令、国会立法提案及限制外国公民访问 Anthropic 最先进模型等监管动向,Nathan Lambert 与 Interconnected 联合撰文警告,未来若监管甚至禁止开源 AI 将是严重错误。
Anthropic 宣布 Claude Code 支持 artifacts,可基于会话完整上下文(代码库、连接器、对话)生成 PR walkthrough、仪表盘、发布清单等实时网页,并随会话进展自动更新。页面默认组织内私有,支持版本历史和管理员权限控制,目前以 beta 形式面向 Claude Team 和 Enterprise 组织开放,可从 Claude Code CLI 和桌面应用使用。
推荐理由:官方说明给出 artifacts 的工作方式、调试场景和组织级权限设置,团队用户可据此评估是否引入协作流程。
Anthropic 的 Python、TypeScript、Go、Java、Ruby、PHP 和 C# SDK 现已支持 code_execution_20260120 代码执行工具版本,该版本新增 REPL 状态持久化,并且是程序化工具调用的最低版本要求。
英国 AI Security Institute 对齐团队与 Timaeus 联合成立非营利研究机构 Sequent,认为"对齐尚未走上正轨",计划两年内扩至 40-80 名全职员工,初期募资 1 亿至 1.5 亿美元,研究方向涵盖可扩展监督、学习理论、博弈论与 personas。
Anthropic 弃用 Claude Sonnet 4(claude-sonnet-4-20250514)和 Claude Opus 4(claude-opus-4-20250514),这两个模型在 Claude API 上的所有请求现在会返回错误。
Claude 平台的代码执行工具现已支持 code_execution_20260521,在工具描述中披露每单元格 90 秒执行时限,便于 Claude 为长耗时单元格做预算,且无需 beta header。
Claude Platform on AWS 现已提供 GET /v1/environments/{id}/work 端点,用于列出自主托管沙箱的待处理工作。该端点由 GetEnvironment 这一 IAM 操作授权,相关 IAM actions 文档已同步更新。
Anthropic 发布 Claude Fable 5(claude-fable-5)面向所有客户,Claude Mythos 5 面向 Project Glasswing 参与者。
推荐理由:官方发布说明完整列出两个新模型的能力参数、tokenizer 变化、API 行为改动和迁移注意事项,对计划接入或迁移的开发者有直接参考价值。
Import AI 460 期汇总多篇研究。KCL、复旦与 Alan Turing Institute 发布 SocioHack 基准,含 72 个沙盒社会环境,RL 训练的 LLM 能以 61.25% 召回率和 90.85% 精确率重新发现历史上已被修补的制度漏洞。
Anthropic 发布 Swift 包,让 Apple 开发者通过 Foundation Models 框架调用 Claude 处理多步推理、代码生成等复杂任务,并支持联网搜索与代码执行。
Anthropic 宣布弃用 Claude Opus 4.1(claude-opus-4-1-20250805),其在 Claude API 上的退役时间定于 2026 年 8 月 5 日。官方建议用户迁移至 Claude Opus 4.8,详情见 Model deprecations 页面。
Claude API 的 advisor 工具新增 max_tokens 参数,可限制顾问模型每次调用的输出长度,降低延迟与输出 token 成本,需在 tools[].max_tokens 中设置。同时,当请求返回 stop_reason: "refusal" 且 Claude 未生成任何输出时,Claude API 不再对该请求计费。
Import AI 第459期:一篇论文估算美国AI经济2025年名义规模约2500亿美元、质量调整产出年增约2600%,但常规GDP统计难以体现;UK AI Security Institute论文说明自动化对齐研究的错误比人类基线更难识别,并给出测量与红队等干预建议。
Claude Managed Agents 的 webhooks、多智能体编排和自托管沙箱现已在 AWS 上的 Claude Platform 提供。官方文档列出了新增的 IAM actions 和 AnthropicSelfHostedEnvironmentAccess 托管策略。
Anthropic 发布 Claude Opus 4.8,为其最强模型,在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上默认支持 1M token 上下文窗口,最大输出 128k token。
推荐理由:原文完整列出 1M 上下文、采样参数限制和各端可用性等迁移要点,接入方可以直接对照判断升级路径。
Claude Messages API 响应新增 usage.output_tokens_details.thinking_tokens 字段,用于显示计费输出 token 中有多少来自扩展思考。流式模式下该明细仅出现在最后一个 message_delta 事件中,且无需 beta header。
Anthropic 联合创始人 Jack Clark 在牛津大学人类中心 AI 实验室发表 2026 年 Cosmos 演讲,主张面对 AI 持续进步应选择探索未来而非回避现实。
Anthropic 在 Claude Managed Agents 中推出 dreaming 研究预览,并开放 outcomes、多智能体编排和 webhooks。
推荐理由:官方公布了 dreaming、outcomes 与多智能体编排的具体机制和内部基准数据,可了解 Managed Agents 的能力边界与实际收益。
Claude 平台发布更新:MCP tunnels 以研究预览形式上线,可连接私有网络中的 MCP 服务器。
Anthropic 宣布 Claude Managed Agents 支持自托管沙箱和 MCP 隧道,让智能体在企业自身边界内执行工具并访问私有网络中的 MCP 服务器。
推荐理由:原文给出自托管沙箱与 MCP 隧道的边界划分和支持的沙箱提供商,读者可据此评估企业内智能体部署路径。
Import AI 457 聚焦三项研究:SentinelOne 拆解出约 20 年前的病毒 fast16.sys,它通过篡改 LS-DYNA 970、PKPM、MOHID 等高精度计算软件的内存结果来破坏科研与工程计算。
Claude 平台的网页搜索工具现已返回更丰富的 SEC 文件数据,便于金融研究智能体、财报分析和尽职调查工作流基于一手来源并附引用。该更新于 2026 年 5 月 18 日发布。
Sierra 发布 𝜏-knowledge,扩展其 𝜏-bench 对话基准,新增 𝜏-Banking 域,包含 698 篇文档、21 个产品类别(约 195K tokens),任务平均需查阅 18.6 篇文档和 9.5 次工具调用。