Runway 将视频编辑模型 Aleph 2.0 接入 Figma Weave
Runway 宣布视频编辑模型 Aleph 2.0 正式登陆 Figma Weave。用户可从视频提取单帧、重绘样式后带时间戳接回 Aleph 2.0 节点,模型将编辑应用到该主体出现的每一帧并保持其余画面不变,支持最长 30 秒、1080p 的多镜头序列编辑,可换产品、改背景或整体重绘场景。
Runway 宣布视频编辑模型 Aleph 2.0 正式登陆 Figma Weave。用户可从视频提取单帧、重绘样式后带时间戳接回 Aleph 2.0 节点,模型将编辑应用到该主体出现的每一帧并保持其余画面不变,支持最长 30 秒、1080p 的多镜头序列编辑,可换产品、改背景或整体重绘场景。
Anthropic 在 Claude Platform 发布说明中宣布,MCP tunnels(研究预览)的管理 API 从 Admin API 的 /v1/organizations/tunnels 迁移至 Claude API 的 /v1/tunnels。
Anthropic 宣布 Claude Code 支持 artifacts,可基于会话完整上下文(代码库、连接器、对话)生成 PR walkthrough、仪表盘、发布清单等实时网页,并随会话进展自动更新。页面默认组织内私有,支持版本历史和管理员权限控制,目前以 beta 形式面向 Claude Team 和 Enterprise 组织开放,可从 Claude Code CLI 和桌面应用使用。
推荐理由:官方说明给出 artifacts 的工作方式、调试场景和组织级权限设置,团队用户可据此评估是否引入协作流程。
Anthropic 的 Python、TypeScript、Go、Java、Ruby、PHP 和 C# SDK 现已支持 code_execution_20260120 代码执行工具版本,该版本新增 REPL 状态持久化,并且是程序化工具调用的最低版本要求。
Google Research 发布矢量化数据集,将 Farmscapes 2020 的高分辨率栅格地图转为可操作的树篱、石墙与矮林清单,覆盖英国超 13 万平方公里。
LMSYS、MOSI 与 OpenMOSS 团队宣布在 SGLang-Omni 上实现 MOSS-TTS-Local-Transformer-v1.5 的端到端服务,该开源 TTS 模型支持 48 kHz 立体声、零样本音色克隆、31 种语言和最长 10 分钟生成。
Sierra 于 3 月推出 Ghostwriter,让用户无需点击或写代码、只需描述需求即可构建和优化 AI 智能体。三个月后,支持主管、运营经理、QA 团队等非技术成员已能直接改进客户体验。Sierra 同时推出优化智能体的 Explorer,持续分析客户对话并找出客户流失、回答不佳和 CSAT 下滑等问题,再由 Ghostwriter 将洞察转化为改进。
Linear 发布 coding sessions、自动化 triage 和 Diffs,Linear Agent 可以从 issue 直接触达实现:阅读 issue 与讨论、调查代码库、提出方案、写代码并开 PR,全程在云端用 Claude Code 或 Codex 等模型与 harness 完成。
推荐理由:Linear 官方给出从 issue 到 PR 的完整执行闭环细节,并附自用数据与 Ramp、Coinbase 案例,读者可评估其对工程流程的影响。
Suno 更新 Stem Separation 功能,提供 Auto Split(最多拆出 12 个 stems)、Split from Mix 和仅限 Premier 的 Advanced Split 三种模式。Advanced Split 可从近 100 种乐器中精确提取;Suno 采用重新生成每个 stem 而非切割混音的做法。该功能适用于平台创作及上传的音乐,需付费订阅。
Claude 平台的代码执行工具现已支持 code_execution_20260521,在工具描述中披露每单元格 90 秒执行时限,便于 Claude 为长耗时单元格做预算,且无需 beta header。
Claude Platform on AWS 现已提供 GET /v1/environments/{id}/work 端点,用于列出自主托管沙箱的待处理工作。该端点由 GetEnvironment 这一 IAM 操作授权,相关 IAM actions 文档已同步更新。
Google DeepMind 发布音频模型 Gemini 3.5 Live Translate,支持 70+ 语言近实时语音到语音翻译,自动检测语言并保留说话者的语调、节奏和音高,全程仅落后说话者几秒。
推荐理由:原文给出模型能力、开放渠道和 Meet 语言扩展细节,读者可据此评估它在会议和翻译场景的可用性。
Anthropic 发布 Swift 包,让 Apple 开发者通过 Foundation Models 框架调用 Claude 处理多步推理、代码生成等复杂任务,并支持联网搜索与代码执行。
Google 在 Gemini Enterprise Agent Platform 上推出基于 Agentic RAG 的 Cross-Corpus Retrieval,相比标准 RAG 在事实性数据集上准确率最高提升 34%。
微软推出转录模型 MAI-Transcribe-1.5,新增关键词偏置功能,可让用户提供领域特定关键词列表来引导预测,模型会结合上下文判断是否应用偏置而非盲目强制匹配。在 FLEURS 多语言基准上,启用关键词偏置后词错误率(WER)降低 30%,在提升专业词汇识别的同时保持通用语音的准确率。
Claude API 的 advisor 工具新增 max_tokens 参数,可限制顾问模型每次调用的输出长度,降低延迟与输出 token 成本,需在 tools[].max_tokens 中设置。同时,当请求返回 stop_reason: "refusal" 且 Claude 未生成任何输出时,Claude API 不再对该请求计费。
Claude Managed Agents 的 webhooks、多智能体编排和自托管沙箱现已在 AWS 上的 Claude Platform 提供。官方文档列出了新增的 IAM actions 和 AnthropicSelfHostedEnvironmentAccess 托管策略。
Mistral 在 AI Now Summit 2026 宣布面向工业工程的整体 AI 栈,并与 Airbus、BMW 和 ASML 合作,覆盖设计、仿真和生产场景。
Mistral 将 Le Chat 升级为统一智能体 Vibe,一个账号覆盖工作与编码场景,已上线 chat.mistral.ai。Work Mode 面向长时多步任务,支持企业知识搜索、数据分析、文档起草、定时任务和可复用技能;Code Mode 提供远程编码会话并推出 VS Code 扩展,CLI 新增技能命令、会话权限控制和 /teleport 迁移。
推荐理由:原文是 Mistral 官方发布,完整列出 Work 与 Code 两种模式的能力、集成入口和各档定价,读者可据此评估是否替换现有工作流。
Mistral AI 发布 Search Toolkit 公测版,一个用于构建 AI 应用生产级搜索管道的开源可组合框架,统一了此前分散的数据摄取、检索与评估三个环节。
推荐理由:官方发布开源搜索框架,把 ingestion、检索和评估整合为统一接口,适合评估它能否减少 RAG 基础设施维护成本。
Linear 发布代码评审产品 Diffs,面向所有套餐开放,目标是让代码评审在不牺牲严谨性的前提下保持快速。评审在 Linear 内打开并关联对应的 issue 和项目,优先级可见;Guided reviews 把大 diff 按工作的推理顺序拆成章节,先展示核心改动,结构化 diff 高亮会剥离格式改动,让 2000 行的 PR 在一次阅读中变得可读。
推荐理由:Linear 官方解释了 Diffs 针对的评审痛点与具体设计,读者可以对照自己团队被 agent 大量 PR 拖慢的评审流程判断是否适用。
Mistral 将 Emmi AI 并入后推出物理 AI,用模型从几何与边界条件直接预测物理场,单次前向传播在单块 GPU 上以秒级完成,替代传统 CFD/FEM 每轮设计动辄数小时至数周的求解流程。该能力面向 ASML、Airbus、Safran、Siemens Energy 等合作伙伴,覆盖产品设计、工装工艺与实时数字孪生三类场景,传统求解器保留用于验证与边缘工况。
Runway 发布 Runway MCP(Model Context Protocol)服务器,把 Runway 接入用户已有的 Agent 和编码工具,在对话中直接生成图像和视频而无需切换上下文。
推荐理由:原文给出了接入方式和可用模型清单,读者可据此判断在自己的 Agent 工作流中调用 Runway 生成是否顺手。
Claude Messages API 响应新增 usage.output_tokens_details.thinking_tokens 字段,用于显示计费输出 token 中有多少来自扩展思考。流式模式下该明细仅出现在最后一个 message_delta 事件中,且无需 beta header。
Mistral 发布 Mistral Medium 3.5,一个 128B 稠密开源权重模型(modified MIT 许可),256k 上下文窗口,SWE-Bench Verified 得分 77.6%,τ³-Telecom 得分 91.4,自托管最少只需四块 GPU,API 定价每百万输入 token $1.5、输出 token $7.5。
推荐理由:官方同步发布模型与云端异步智能体,给出基准分数、定价和开源权重,可对照评估其编码与长程任务能力。
Mistral 发布 Studio 的 Connectors(Public Preview),内置连接器和自定义 MCP 可通过 API/SDK 用于所有模型与 Agent 调用。
Runway 发布视频编辑模型 Aleph 2.0,并同步推出围绕其构建的 Edit Studio 应用。新模型支持编辑最长 30 秒的 1080p 视频,可做仅改动目标区域的局部编辑,用一帧编辑后的图像预览并控制最终效果,还能一次把改动应用到多个镜头。Edit Studio 面向营销团队、影视后期等场景,现已在所有 Runway 付费计划的桌面网页端开放。
推荐理由:原文给出了模型能力细节和开放范围,读者可以据此判断对现有视频素材二次加工工作流的影响。
Google DeepMind 的 Co-Scientist 帮助 Omar Abudayyeh 和 Jonathan Gootenberg 的实验室筛选逆转细胞衰老的基因线索,它扫描数万篇论文后提出 20 多个新颖候选遗传因子,其中数个经实验室验证成功将细胞推向更年轻状态并改善整体功能。Co-Scientist 还将原本需长达六个月的筛选数据分析缩短至几天。
Anthropic 在 Claude Managed Agents 中推出 dreaming 研究预览,并开放 outcomes、多智能体编排和 webhooks。
推荐理由:官方公布了 dreaming、outcomes 与多智能体编排的具体机制和内部基准数据,可了解 Managed Agents 的能力边界与实际收益。
Claude 平台发布更新:MCP tunnels 以研究预览形式上线,可连接私有网络中的 MCP 服务器。
Anthropic 宣布 Claude Managed Agents 支持自托管沙箱和 MCP 隧道,让智能体在企业自身边界内执行工具并访问私有网络中的 MCP 服务器。
推荐理由:原文给出自托管沙箱与 MCP 隧道的边界划分和支持的沙箱提供商,读者可据此评估企业内智能体部署路径。
Google DeepMind 在 Project Genie 中推出基于 Street View 的世界生成能力,用户可通过 Maps 图钉选择美国地点并叠加 Ocean World、B&W film 等风格,生成起点绑定真实街景的交互式世界,底层由 Maps Imagery Grounding 驱动。
Claude 平台的网页搜索工具现已返回更丰富的 SEC 文件数据,便于金融研究智能体、财报分析和尽职调查工作流基于一手来源并附引用。该更新于 2026 年 5 月 18 日发布。
爱丁堡大学团队用 Google Co-Scientist 研究 MASH 肝病,系统整合肝脏生物学与药理学证据,锁定值得关注的机制并筛选出候选组合疗法。针对 resmetirom 仅对少数合格患者有效的问题,Co-Scientist 提出 NLRP3 炎症小体是连接炎症与代谢的分子桥梁,该假说随后经实验验证,有望推动靶向双重疗法。
MIT 的 Ritu Raman 与波士顿儿童医院的 Ryan Flynn 借助 Google DeepMind 的 Co-Scientist,将组织工程与 RNA 表面图谱两套工具结合用于 ALS 研究。
Stanford 医学院遗传学家 Gary Peltz 团队在 Advanced Science 发表研究,用 Co-Scientist 从现有药物文献中筛选可重定位治疗肝纤维化的药物。
推荐理由:原文给出 Co-Scientist 与人类专家选药的真实对比实验结果,读者可以据此了解 AI 辅助药物重定位的实际表现。
Linear 推出 Code Intelligence,作为 Linear Agent 的新功能,让智能体可以按需或自动对代码库进行研究,现在面向 Business 和 Enterprise 计划开放公测,公测期间免费。
推荐理由:官方说明了产品如何把代码上下文引入问题分诊、支持与产品规划流程,并给出内部使用量增长数据,可帮助读者评估其适用场景。
Runway 推出 Runway Agent,一个智能体创意伙伴,可在单次对话中从想法产出可发布的成品视频,包含多镜头画面、旁白、对白和音乐。用户用自然语言描述需求,可上传参考图、选择画幅比例和时长,逐步对话确定概念与故事结构后生成视频,再用时间线编辑器做最终调整,官方称可在数分钟内产出高分辨率多镜头视频。产品面向品牌团队、营销人员、创意机构、社媒内容团队和影视创作者,现已开放使用。
推荐理由:Runway 官方宣布 Agent 上线并给出工作方式与适用场景,读者可以据此判断对话式视频生产对内容团队的适用度。
Anthropic 在 Claude API 上线缓存诊断公开测试版,请求中传入 diagnostics.previous_message_id 后,API 会返回 cache_miss_reason,说明提示词缓存前缀在何处与上一轮发生偏离。使用该功能需在请求中带上 cache-diagnosis-2026-04-07 beta header。
Claude Opus 4.7 现已支持快速模式(研究预览),可通过设置 speed: "fast"、model: "claude-opus-4-7" 并搭配 fast-mode-2026-02-01 beta header 使用,以显著更快的输出 token 生成速度换取溢价定价。其定价、速率限制和访问权限与 Opus 4.6 快速模式相同,感兴趣的客户需加入等待列表。