Anthropic Compliance API 新增 Cowork 会话记录接口,面向 Claude Enterprise 开放 beta
Anthropic 的 Compliance API 现可返回在 claude.ai 网页端或移动端发起的 Cowork 会话记录,该功能面向 Claude Enterprise 组织开放 beta。
Anthropic 的 Compliance API 现可返回在 claude.ai 网页端或移动端发起的 Cowork 会话记录,该功能面向 Claude Enterprise 组织开放 beta。
Claude 的 Dreams 研究预览版现已支持 Claude Opus 5,具体可用模型范围见官方支持模型列表。
Skyscanner 品牌团队在美加品牌广告拍摄中引入 Runway,用于锁定构图、布光和演员走位,并在片场实时验证拍摄效果。团队用 Runway 生成酒吧、水疗、海滩和酒店阳台等场景环境,还借助 AI 生成临时背景检查服装与道具,使预可视化与实际成片的差距很小。
Sierra 发布 Agency 智能体沙箱编排层,为 Pinecone 和 Ghostwriter 的每个会话与任务提供安全运行环境。Agency 基于 Kubernetes 构建,分无状态控制平面与有状态 runner 两层,每个 runner 配备 8+ 核、24GiB 内存和持久化存储,并默认不向智能体暴露任何 API key 或密钥。
Google DeepMind 发布最新音乐生成模型 Lyria 3.5,当日在 Google Flow Music 上线。改进包括更丰富自然的旋律结构、歌词质量与提示词遵循提升、更真实且情感细腻的人声与发音,并新增对输出节奏和时长的控制。
RadixArk 与 Google Cloud 合作,把开源推理框架 SGLang 带到 TPU。SGL-JAX 现已可用,支持 Gemma、Qwen、DeepSeek。
SGLang 和 Miles 发布对 Kimi K3 的 Day-0 支持,分别覆盖推理与 RL 训练。K3 为 2.8T 参数的 3 万亿参数级首个开源模型,采用 69 层 KDA 线性注意力与 24 层 MLA 的混合架构和 1M token 上下文窗口。
推荐理由:原文由 SGLang 团队自述 Day-0 支持的实现细节,给出内存管理、投机解码与并行策略的具体方案和实测数字,可迁移到异构注意力架构的部署。
OpenRouter 推出 beta 版 Classifiers,可在每个请求完成后异步分类,为生成记录写入结构化元数据,用于 AI 用量和成本追踪。
Runway 推出 Runway Media Router,称其为首个面向生成式媒体模型的路由功能,已在 Runway Dev 上线,支持视频、图像和音频模型。用户设定成本、质量、延迟偏好及价格上限、允许和拒绝列表等约束后,只调用一个端点,路由器会筛选并评分选出最优模型,返回结果及所用模型的元数据;无模型满足约束时报明确错误,生产前可用 dry-run 验证选型且不产生费用。
OpenRouter 上线 POST /api/v1/audio/transcriptions 音频转写端点,复用 Chat Completions 的同一 API key 和鉴权。
推荐理由:官方教程给出了完整的请求参数、限制和计费细节,读者可以直接照抄接入而不必自建 Whisper 服务。
Claude Managed Agents 的模型配置现可设置 effort 等级,创建 agent 时在 model 对象中传入即可。Webhooks 新增 environment.* 四类与 memory_store.* 三类事件,无需轮询即可响应生命周期变化。
Linear 发布 Loops,让 Linear Agent 以定时或事件触发的方式承担团队重复性运营工作。Loop 用自然语言描述,运行时可结合 Linear 内的 issue、项目、文档、连接的代码库和 MCP 服务器,团队内共享可见和可控。
Miles 将 On-Policy Distillation(OPD)集成进 rollout 与训练流程,支持纯蒸馏和结合 GRPO/PPO 的 RL 增强蒸馏两种模式,并通过稀疏 student-to-teacher 打分避免 O(R²K) 的密集 payload。
Runway 近期推出 Runway Agent 2.0,可将单一想法转化为完整创意作品,并支持在界面内把视频片段、音频和图像整合到同一条时间线。该产品在 Physion Labs 的 Arc 1.0 benchmark 中于六款 AI 视频智能体中排名第一,评测覆盖电影质感、连贯性以及信任与安全。Agent 内置对不同模型强弱项的认知和技能层,面向营销人员及影视创作等场景。
Claude Console 中的旧版 Workbench 将于 2026 年 8 月 17 日停止访问,更新后的 Workbench 不再支持已保存的提示词、变量和 evals,用户可从横幅和组织设置中导出需保留的数据。
Sierra 发布 Horizon 平台,让智能体能够追求贷款办理、医疗预授权等长周期目标,跨天、跨周甚至跨月主动与客户互动。Horizon 在 Agent OS 基础上加入长周期规划与上下文引擎,智能体可从每次互动中学习优化决策,且按业务成果而非 token 计费。
OpenRouter 宣布可用单一 OpenAI 兼容 base URL 调用图像、视频、音频、嵌入和转录等全部模态,切换模态只需改模型字符串和内容类型。
Sierra 发布内部云 Agent 平台 Pinecone,让员工在浏览器、Slack、Linear 或手机上创建、共享和自动化云端智能体会话。每个会话约一秒内获得带代码仓库、构建缓存和开发服务的隔离环境,并提供多人协作、自动盯 PR、定时自动化、可复用 Skills 和多会话 Projects 等能力。
推荐理由:Sierra 官方复盘自研内部云 Agent 的架构与经验,读者可以从中了解企业如何沉淀员工工作智慧并组织智能体协作。
SGLang 与 Miles 团队同 Thinking Machines Lab 合作,为 975B 参数、上下文最长 1M tokens 的多模态模型 Inkling 提供 Day-0 支持。
推荐理由:原文给出 Inkling 架构细节、SGLang 各项优化后的具体吞吐数字,以及 Miles 侧完整 RL 训练方案,工程参考价值具体。
Claude Fable 5、Claude Mythos 5 和 Claude Opus 4.8 现已在 Claude API、Amazon Bedrock 和 Google Cloud 上支持对话中途系统消息,且无需 beta header。此次更新修正了此前的可用性说明。
Claude Enterprise(claude.ai)组织现可通过 Admin API 管理成员,该功能面向所有 Claude Enterprise 组织开放测试版,支持列出成员、按邮箱查找、修改角色、移除成员、发送与撤回邀请、管理群组及其成员关系,以及读取自定义角色。
Google DeepMind 在印度启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为 Tinkering Lab 教师提供 24/7 规划与培训助手。
OpenRouter 发文解释为何要经其路由调用 DeepSeek:同一个 DeepSeek V4 Pro 由 16 家供应商提供,输入价格从约 $0.44/M 到 $1.74/M 相差约 4 倍,吞吐从 4 到 57 tokens/s,uptime 约 97% 至近 100%。
Runway 开源 AVTensor,一个直接调用 FFmpeg C API 的 Rust 媒体解码器,单次 demux 同时解码音频与视频并共享时间原点,解决了 torchcodec 与 torchaudio 在负 PTS 资产上时间零点不一致导致的音画失步问题。
Claude Dreams 研究预览版现已支持 Claude Fable 5 和 Claude Sonnet 5。
Mistral Studio 即日起为 Prompts 和 Skills 提供集中式系统记录,每个资产都具备版本管理、归属和可追溯性。不可变版本、回滚、分类标签和审计日志等功能让 AI 行为可治理、可发现,并支持通过 MCP 服务器直接调用 Skills。该功能面向 Mistral Studio 客户开放,数据始终保留在企业边界内。
微软 AI 与诗歌推广人 William Sieghart、创意工作室 Gravity Road 合作推出数字诗歌体验 Ode Poetry,基于 MAI 音频模型实现实时对话与诗歌推荐。
Anthropic 在 Claude Console 中支持创建 API key 或 Admin API key 时设置有效期,可选预设时长、自定义时长或永不过期。有效期不少于 7 天的 key,Anthropic 会在到期前邮件通知创建者,已有 key 不受影响。Admin API 通过 expires_at 字段返回每个 key 的到期时间。
Hugging Face LeRobot 团队发布 v0.6.0,引入 VLA-JEPA、LingBot-VA、FastWAM 三个世界模型策略,新增 GR00T N1.7、MolmoAct2、EO-1 等 VLA,以及 Robometer、TOPReward 奖励模型和统一奖励 API。
推荐理由:官方完整发布说明覆盖世界模型策略、奖励模型、基准与部署 CLI,读者可据此评估是否升级自己的机器人训练工作流。
Hugging Face 官方博客总结 🤗 Kernels 项目数月来的重大更新,包括 Hub 新增 kernel 仓库类型、默认仅加载受信任发布者的 kernel、基于 Sigstore cosign 的代码签名、重构 kernels 与 kernel-builder 的 CLI。
SGLang 现已支持 DSpark 投机解码,在 dense 和 sparse 模型(如 Qwen3、DeepSeek-V4)上均可用。DSpark 采用半自回归块草稿器与基于草稿模型置信度的逐请求变长验证,减少无效 token 验证。在 H200 上以 DeepSeek-V4-Flash 测试,其吞吐/延迟权衡在整个并发扫描中优于 MTP 和非投机基线。
Anthropic 新增 agent-memory-2026-07-22 beta header,改变记忆列表接口行为:结果按服务端固定顺序返回,order_by 和 order 参数被忽略,depth 仅接受 0、1 或省略,path_prefix 必须以 / 结尾并按整段路径匹配。
Hugging Face 与 Cerebras 展示了一套全开源、模块化可替换的实时语音到语音流水线,语言模型采用 Google DeepMind 的 Gemma 4 31B,在 Cerebras 上推理,语音识别用 Nvidia Parakeet,语音合成用 Alibaba Qwen3TTS。
Sierra 在 Agent Studio 中推出 Experiments,为团队提供运行、审查和发布 A/B 测试的统一界面,每项实验默认按解决率和流失率降低等结果指标评估。Ghostwriter 会分析全部客户对话,将发现的模式转化为假设并在数分钟内发布为实验。团队可逐步放量,确认统计显著后将胜出版本推至 100% 流量。
Google Research 将建筑级屋顶反射率数据集扩展至 9 个国家 50+ 城市,并通过新的 Heat Resilience Earth Engine App 开放访问。该方法融合 Sentinel-2 与 30-cm 高分辨率卫星影像,验证 RMSE 仅 0.04,建模显示定向 cool-roof 规划可使全球城市极端高温降低最多 0.5°C。
Anthropic 已恢复 Claude Fable 5 和 Claude Mythos 5 的访问权限。官方表示相关说明可参见其声明,但未披露此次中断的具体原因与时长。
Anthropic 已移除 Claude Opus 4.6 的快速模式,请求 claude-opus-4-6 时带 speed: "fast" 不再以快速速度和溢价计费,而是按标准速度运行、按标准费率计费且不报错,响应中的 usage.speed 字段会报告实际使用的速度。要继续使用快速模式,需迁移至 Claude Opus 4.8。
Anthropic 上调 Claude API 速率限制,Claude Sonnet 和 Claude Haiku 的限额在所有用量层级上与 Claude Opus 持平,用量层级合并为 Start、Build、Scale 三档。多数组织将升至更高层级,没有组织的限额低于此前,且无需任何操作,可在 Claude Console 查看当前层级与限额。
Runway 发布 Agent 2.0,一款面向营销人员的升级版智能体,已向所有用户开放。用户可在对话中导入广告投放、产品发布或目标受众等信息,Agent 会分析并提问,协助生成和优化营销内容。它支持从 Meta、YouTube、TikTok、Google 导入广告指标,并自动输出 9:16、16:9、1:1 等平台适配格式。
Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前该能力仅由独立的 Gemini 2.5 computer use 模型提供。
推荐理由:原文说明 computer use 从独立模型并入 Gemini 3.5 Flash,并给出 API 入口与企业级防护选项,便于开发者评估接入。