Codex 现在可以控制和操作 Windows 电脑,包括通过 ChatGPT 手机 App 使用。用户可以在 PC 上继续运行任务的同时,远程启动、监控并引导编码任务。
推荐理由:原文给出 Codex 控制 Windows 与手机端远程操作的能力,读者可据此了解编码任务远程接管的入口。
AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。
当前仅显示精选新闻Codex 现在可以控制和操作 Windows 电脑,包括通过 ChatGPT 手机 App 使用。用户可以在 PC 上继续运行任务的同时,远程启动、监控并引导编码任务。
推荐理由:原文给出 Codex 控制 Windows 与手机端远程操作的能力,读者可据此了解编码任务远程接管的入口。
推荐理由:OpenAI 官方给出 Codex 在 Windows 上的操作能力与移动端接续入口,读者可据此判断现有工作流能否迁移。
推荐理由:官方公布新订阅档位的价格与用量差异,读者可比对该计划与现有档位的能力边界。
推荐理由:官方给出 Gemini Omni 的多模态输入组合和订阅档位,读者可据此判断该视频生成功能的可用范围。
Claude Code 发布研究预览版 Dynamic Workflows,由 Claude 现场编写编排脚本,并发启动大量协同 Subagent 处理复杂任务。
New in Claude Code (research preview): dynamic workflows. Claude writes an orchestration script on the fly, then spins up a large fleet of coordinated subagents in parallel to take on your most complex tasks. Use the word "workflow" in a prompt to get started.
推荐理由:作者补充了官方公告之外的触发方式和 Ultra Code 模式限制,便于判断这一功能如何接入现有流程。
New in Claude Code (research preview): dynamic workflows. Claude writes an orchestration script on the fly, then spins up a large fleet of coordinated subagents in parallel to take on your most complex tasks. Use the word "workflow" in a prompt to get started.
推荐理由:该功能把编排脚本生成与并行子智能体调度交给 Claude 自己完成,可用于观察多智能体工作流的实现方式。
Claude Code 发布 v2.1.154,引入 Opus 4.8 作为默认模型并默认高推理强度,可用 /effort xhigh 处理最难任务。新增动态 workflow,可协调数十到数百个后台 Agent,用 /workflows 查看;Opus 4.8 的 fast mode 降价为标准费率 2 倍换 2.5 倍速度;另有多项修复,包括阻止 rm -rf $HOME、改进数据外泄检测等。
推荐理由:发布说明列出 Opus 4.8 默认高推理、动态 workflow 编排多 Agent 与 fast mode 降价等变化,读者可据此评估升级对现有工作流的影响。
推荐理由:Gemini Omni 面向 Google AI Plus、Pro、Ultra 订阅用户全球开放,读者可据此确认自身订阅是否覆盖该功能。
Mistral 将 Le Chat 升级为统一智能体 Vibe,一个账号覆盖工作与编码场景,已上线 chat.mistral.ai。Work Mode 面向长时多步任务,支持企业知识搜索、数据分析、文档起草、定时任务和可复用技能;Code Mode 提供远程编码会话并推出 VS Code 扩展,CLI 新增技能命令、会话权限控制和 /teleport 迁移。
推荐理由:原文是 Mistral 官方发布,完整列出 Work 与 Code 两种模式的能力、集成入口和各档定价,读者可据此评估是否替换现有工作流。
Mistral AI 发布 Search Toolkit 公测版,一个用于构建 AI 应用生产级搜索管道的开源可组合框架,统一了此前分散的数据摄取、检索与评估三个环节。
推荐理由:官方发布开源搜索框架,把 ingestion、检索和评估整合为统一接口,适合评估它能否减少 RAG 基础设施维护成本。
Linear 发布代码评审产品 Diffs,面向所有套餐开放,目标是让代码评审在不牺牲严谨性的前提下保持快速。评审在 Linear 内打开并关联对应的 issue 和项目,优先级可见;Guided reviews 把大 diff 按工作的推理顺序拆成章节,先展示核心改动,结构化 diff 高亮会剥离格式改动,让 2000 行的 PR 在一次阅读中变得可读。
推荐理由:Linear 官方解释了 Diffs 针对的评审痛点与具体设计,读者可以对照自己团队被 agent 大量 PR 拖慢的评审流程判断是否适用。
Anthropic 为 Claude Code 推出动态工作流,Claude 可动态编写编排脚本,在单次会话中并行运行数十到数百个子智能体,并在结果交付前自行校验。
推荐理由:官方给出了并行子智能体编排的能力边界与 Bun 重写中的实际用例,便于判断它能否承接超长任务。
Gemini Omni 已面向全球 Google AI Plus、Pro 和 Ultra 订阅用户开放,覆盖网页端和 Gemini 应用。该消息由 Gemini 官方账号发布。
推荐理由:原文给出 Gemini Omni 对全球 Google AI 订阅用户开放的具体范围,读者可据此确认自己是否在覆盖名单内。
Gemini App 表示,Gemini Omni 可将文本、视频或最多五张图片作为素材,合成为一段连贯的十秒视频。该功能现已开放试用,官方邀请用户在回复中分享作品。
推荐理由:把文本、视频和多图素材统一到十秒视频输出,读者可了解 Gemini Omni 的多模态拼合方式。
Runway 发布 Runway MCP(Model Context Protocol)服务器,把 Runway 接入用户已有的 Agent 和编码工具,在对话中直接生成图像和视频而无需切换上下文。
推荐理由:原文给出了接入方式和可用模型清单,读者可据此判断在自己的 Agent 工作流中调用 Runway 生成是否顺手。
小米 MiMo API 大幅降价,2.5 Pro 输入价格降幅达 99%,输出降价 80%。Token plan 额度也较此前提升 5-8 倍,并重置了所有人的额度。



推荐理由:小米 MiMo API 大幅下调输入输出价格并提升 Token 额度,读者可据此判断其调用成本变化。
Hugging Face 在 TRL 中实现 Delta Weight Sync,只把 RL 相邻优化步骤间真正变化的 bf16 权重编码为稀疏 safetensors 文件,上传到 Hugging Face Bucket 后由 vLLM 拉取。
推荐理由:TRL 通过稀疏增量同步把异步 RL 每步权重传输量压缩约两个数量级,并允许 trainer 与推理集群分离部署。
MiniMax 发布 Agent 整体升级并更名 Mavis,推出 Agent Teams,支持桌面端并行运行多角色 Agent 协作完成长任务,并将 TokenPlan 与 Agent Plan 合并为统一订阅,Agent 与 API 共享 Credits。
推荐理由:官方详解 Agent Team 的角色分工、状态机设计和上下文成本等工程取舍,读者可以据此理解多智能体产品化的关键问题。
🚀 Better inference efficiency, lower costs, broader access. MiMo-V2.5 Series API pricing is now permanently reduced — by up to 99% compared to previous pricing. ✨ Unified pricing across all context lengths. MiMo Token Plans have also been upgraded: • 5–8× more usable tokens at the same price • Simpler and more transparent billing rules 🎁 As a thank-you to current users, all current Token Plan credits will be fully reset. 🎧 MiMo-V2.5-TTS remains free for a limited time. ⏰ Effective May 26 at 6:00 PM PDT. These improvements are powered by continued inference optimization and serving efficiency upgrades across the MiMo stack. 🛠️ We’ll also publish a detailed technical blog on the inference optimizations later — stay tuned.
推荐理由:原文列出 API 价格最高降 99% 与 Token 套餐升级,读者可借此观察推理成本下探对模型选型的影响。
ElevenLabs 发布 Music v2,在各类曲风下提升人声、器乐与编曲能力,支持多语言歌词,单首歌曲可在歌剧与重金属间切换并内嵌非音乐音效,改进 inpainting 可局部重生成任意段落,并支持从 intro 到 chorus 逐段构建完整歌曲。
推荐理由:原文列出了模型在人声、分段重构和多语言上的具体能力变化与降价幅度,读者可据此评估是否纳入创作或产品流程。