Google DeepMind 将 computer use 内置到 Gemini 3.5 Flash
Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前该能力仅由独立的 Gemini 2.5 computer use 模型提供。
推荐理由:原文说明 computer use 从独立模型并入 Gemini 3.5 Flash,并给出 API 入口与企业级防护选项,便于开发者评估接入。
Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前该能力仅由独立的 Gemini 2.5 computer use 模型提供。
推荐理由:原文说明 computer use 从独立模型并入 Gemini 3.5 Flash,并给出 API 入口与企业级防护选项,便于开发者评估接入。
Suno 推出名为 Spark 的孵化计划,面向独立音乐人提供资助、导师指导和专属营销支持。入选者还可参加写作营与成熟艺人合作,并对 Suno 新功能提供反馈,同时保留作品的创作控制权和商业权利。该计划即日起开放申请。
Anthropic 已弃用 Claude Opus 4.7 的 fast mode,并将于 2026 年 7 月 24 日移除。移除后,向 claude-opus-4-7 发送 speed: "fast" 的请求将返回错误,官方建议迁移至 Claude Opus 4.8 的 fast mode。
Mistral 为 Connectors 推出多项新能力:按 workspace 或组织管理连接器访问、可单独开关工具的管理员控制(GA),带连接器权限范围的 API key(GA),以及支持多账号登录的连接器(GA)。
Mistral 发布 Mistral OCR 4,除提取文本外还返回边界框、块类型分类(标题、表格、公式、签名等)和逐页逐词的内联置信度分数,支持 170 种语言、10 个语言组。
推荐理由:官方说明了新模型的结构化输出能力、基准得分及其已知评分缺陷,并给出 API 与 Document AI 的选择规则,便于读者判断适用场景。
Runway 宣布视频编辑模型 Aleph 2.0 正式登陆 Figma Weave。用户可从视频提取单帧、重绘样式后带时间戳接回 Aleph 2.0 节点,模型将编辑应用到该主体出现的每一帧并保持其余画面不变,支持最长 30 秒、1080p 的多镜头序列编辑,可换产品、改背景或整体重绘场景。
Anthropic 在 Claude Platform 发布说明中宣布,MCP tunnels(研究预览)的管理 API 从 Admin API 的 /v1/organizations/tunnels 迁移至 Claude API 的 /v1/tunnels。
Anthropic 宣布 Claude Code 支持 artifacts,可基于会话完整上下文(代码库、连接器、对话)生成 PR walkthrough、仪表盘、发布清单等实时网页,并随会话进展自动更新。页面默认组织内私有,支持版本历史和管理员权限控制,目前以 beta 形式面向 Claude Team 和 Enterprise 组织开放,可从 Claude Code CLI 和桌面应用使用。
推荐理由:官方说明给出 artifacts 的工作方式、调试场景和组织级权限设置,团队用户可据此评估是否引入协作流程。
Anthropic 的 Python、TypeScript、Go、Java、Ruby、PHP 和 C# SDK 现已支持 code_execution_20260120 代码执行工具版本,该版本新增 REPL 状态持久化,并且是程序化工具调用的最低版本要求。
Google DeepMind 与英国政府、Google Cloud、Faculty 及 Barnet、Dorset、Camden 三个地方规划部门合作,开发基于 Gemini 的规划工具原型,目标是帮规划官员将 householder 申请决策时间缩短 50%,英国计划 2027 年起向全国 council 推广。
Google Research 发布矢量化数据集,将 Farmscapes 2020 的高分辨率栅格地图转为可操作的树篱、石墙与矮林清单,覆盖英国超 13 万平方公里。
LMSYS、MOSI 与 OpenMOSS 团队宣布在 SGLang-Omni 上实现 MOSS-TTS-Local-Transformer-v1.5 的端到端服务,该开源 TTS 模型支持 48 kHz 立体声、零样本音色克隆、31 种语言和最长 10 分钟生成。
SGLang-JAX 现已支持在 TPU v7x 上高效服务 inclusionAI 的 Ling-2.6-1T,其新 Pallas kernel Fused MoE V2 将 MoE prefill 延迟从 5.16 ms 降至 2.42 ms(降幅 53%),decode kernel 延迟从 0.249 ms 降至 0.211 ms。
Sierra 于 3 月推出 Ghostwriter,让用户无需点击或写代码、只需描述需求即可构建和优化 AI 智能体。三个月后,支持主管、运营经理、QA 团队等非技术成员已能直接改进客户体验。Sierra 同时推出优化智能体的 Explorer,持续分析客户对话并找出客户流失、回答不佳和 CSAT 下滑等问题,再由 Ghostwriter 将洞察转化为改进。
Anthropic 弃用 Claude Sonnet 4(claude-sonnet-4-20250514)和 Claude Opus 4(claude-opus-4-20250514),这两个模型在 Claude API 上的所有请求现在会返回错误。
Z Lab、SGLang 与 Modal 联合发布面向 Qwen 3.5 397B-A17B 的 DFlash 投机解码草拟模型,并随 SGLang 新的 Spec V2 引擎默认可用。
Vivid Seats 上线 AI 客服不到四周,问题解决率提升 40%、客户满意度提升 35%,CX 团队转向根因修复并将实时洞察反哺产品开发。Wilson 的 AI 智能体可追问身高与偏好来推荐具体商品,Minted 则用 AI 智能体打通各客户平台,识别趋势并分发洞察。
加州大学圣地亚哥分校在 Google 支持下,计划用 2000 台退役 Pixel 手机的主板搭建数据中心,为数百名师生提供低成本、低碳的云计算服务。该项目将手机主板组成 25-50 台的 Kubernetes 集群,SPEC 基准显示 25-50 台手机约等于一台现代服务器,20 台手机的集群已能支撑 75 人以上班级的评分负载且延迟低于 AWS 默认后端。系统预计 2026 年秋季上线。
Linear 工程师分享用 Linear Agent 自动修复进入 triage 的 bug 的经验。通过 Datadog 监控发现死 feature flag(任务形状固定,几乎每次一次修复成功)和失败的后台任务(失败率超 0.2% 时建 issue,约三分之一修复命中),并加入门控让 agent 先证明理解问题以节省 token。
Linear 发布 coding sessions、自动化 triage 和 Diffs,Linear Agent 可以从 issue 直接触达实现:阅读 issue 与讨论、调查代码库、提出方案、写代码并开 PR,全程在云端用 Claude Code 或 Codex 等模型与 harness 完成。
推荐理由:Linear 官方给出从 issue 到 PR 的完整执行闭环细节,并附自用数据与 Ramp、Coinbase 案例,读者可评估其对工程流程的影响。
Runway 与 Lionsgate 宣布扩大战略合作,Lionsgate 持有 Runway 股权,双方将启动联合开发项目制作新 IP,首个项目是基于 Lionsgate 现有 IP 与 Runway 生成模型的短剧集系列。
Sierra 与 Knox Systems 合作获得 FedRAMP High 认证,可面向美国联邦机构提供 AI 智能体服务,此时距其成立仅两年多。该技术已被 40% 的 Fortune 50 企业采用,支持语音、聊天和邮件渠道及 58 种语言,全天候运行。Cigna 用其智能体在八周内投产,将患者身份验证时间缩短 80%。
Google Research 在 AISTATS 2026 提出 Regularized f-Divergence Kernel Tests,用于审计机器学习遗忘。
Suno 更新 Stem Separation 功能,提供 Auto Split(最多拆出 12 个 stems)、Split from Mix 和仅限 Premier 的 Advanced Split 三种模式。Advanced Split 可从近 100 种乐器中精确提取;Suno 采用重新生成每个 stem 而非切割混音的做法。该功能适用于平台创作及上传的音乐,需付费订阅。
Claude 平台的代码执行工具现已支持 code_execution_20260521,在工具描述中披露每单元格 90 秒执行时限,便于 Claude 为长耗时单元格做预算,且无需 beta header。
Linear 推出 Diffs 功能,用于应对智能体生成代码带来的审查压力:2026 年 1 月至 3 月,其团队新建 issue 与合并 PR 数量均上升 50%。该功能把审查集中到 Linear 内,支持一键查看代码变更背后的客户反馈或 bug 报告,并将改动分组为可读的叙事块,作者可直接在 Linear 中用智能体处理评论。
Claude Platform on AWS 现已提供 GET /v1/environments/{id}/work 端点,用于列出自主托管沙箱的待处理工作。该端点由 GetEnvironment 这一 IAM 操作授权,相关 IAM actions 文档已同步更新。
Google DeepMind 发布音频模型 Gemini 3.5 Live Translate,支持 70+ 语言近实时语音到语音翻译,自动检测语言并保留说话者的语调、节奏和音高,全程仅落后说话者几秒。
推荐理由:原文给出模型能力、开放渠道和 Meet 语言扩展细节,读者可据此评估它在会议和翻译场景的可用性。
Anthropic 发布 Claude Fable 5(claude-fable-5)面向所有客户,Claude Mythos 5 面向 Project Glasswing 参与者。
推荐理由:官方发布说明完整列出两个新模型的能力参数、tokenizer 变化、API 行为改动和迁移注意事项,对计划接入或迁移的开发者有直接参考价值。
Anthropic 发布 Swift 包,让 Apple 开发者通过 Foundation Models 框架调用 Claude 处理多步推理、代码生成等复杂任务,并支持联网搜索与代码执行。
Google 在 Gemini Enterprise Agent Platform 上推出基于 Agentic RAG 的 Cross-Corpus Retrieval,相比标准 RAG 在事实性数据集上准确率最高提升 34%。
Google Research 在 Nature 发表 PHRM 研究系统,利用人脸解锁后的前摄视频,在日用手机过程中后台跟踪心率与每日静息心率(RHR)。
推荐理由:原文给出跨肤色验证数据和开放数据集申请入口,读者可以据此评估手机摄像头被动心率监测的可用性。
Anthropic 宣布弃用 Claude Opus 4.1(claude-opus-4-1-20250805),其在 Claude API 上的退役时间定于 2026 年 8 月 5 日。官方建议用户迁移至 Claude Opus 4.8,详情见 Model deprecations 页面。
Miles 团队提出 Token-In-Token-Out(TITO)原则,要求第 n 轮 prompt 的 token 序列必须与第 n-1 轮 prompt+response 逐位一致,以消除智能体 RL 中训练与推理的 token 序列不匹配。
Suno 发布 Voices 功能使用指南,给出 6 个提升人声表现力的技巧:在安静环境录制、提前练习、不必追求完美、尽量录长(建议至少 1 分钟)、让声音匹配曲风、大胆尝试意外风格。Voices 已在 Web、iOS 和 Android 上线,可免费试用,付费方案提供更多功能。
Google Research 在 GitHub 上以 Apache 2.0 许可开源其水文模型框架,供各国气象水文部门将 AI 洪水预报接入自有工作流。
Sierra 回顾 2024 年 12 月提出按结果(outcome-based)定价以来的经验:自那时起 S&P 500 上涨约 30%,而 SaaS 指标 WCLD 下跌约 15%。文章引用 Madhavan Ramanujam 的 2x2 框架(自主性与结果归因)定位定价模式,认为按结果定价只有在软件高度自主且结果可清晰归因时才可行,并判断最终能存续的是卖结果而非卖访问权的公司。
推荐理由:Sierra 作者基于自身按结果定价的实践复盘其得失,并用一个 2x2 框架解释为何席位制 SaaS 正承压。
SGLang 与 Miles 团队宣布 Day-0 支持 NVIDIA Nemotron 3 Ultra,一个面向长程自主智能体的开源推理模型,采用混合 Transformer-Mamba 架构的 Latent MoE,总参数 550B、激活 55B,上下文最长 1M token,支持 NVFP4 与 BF16 推理。
Microsoft 发布文本转语音模型 MAI-Voice-2,在保真度、语言覆盖、说话人一致性和情感范围上较前代显著提升。支持语言从英语扩展到 15 种,提供情感标签细粒度控制,可用 5-60 秒参考音频零样本创建自定义声音,且生产环境仅允许授权声音合成。
推荐理由:官方发布给出语言扩展、零样本克隆与偏好测试数据,读者可据此评估该语音模型在生产场景中的可用性。
Suno 宣布完成超 4 亿美元 D 轮融资,投后估值 54 亿美元,由 Bond Capital 领投,IVP、Forerunner、Union Square Ventures、Alkeon 和 Quiet 参投,现有投资者 Matrix、Lightspeed、Menlo Ventures 和 Schroders Capital 跟投。
推荐理由:Suno 官方公布融资规模、估值与投资方,并预告将与音乐行业合作推出首个音乐模型,读者可据此了解其后续方向。