OpenAI 公布为 Codex 构建 Windows 沙箱的实现思路,目的是让编码智能体保持可用,不必在频繁审批弹窗与整机访问权限之间二选一。官方在文中附上了说明页面链接。
推荐理由:官方拆解 Codex Windows 沙箱的实现,为编码智能体在权限审批与整机访问之间提供一种工程折中思路。
让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。
当前仅显示精选新闻OpenAI 公布为 Codex 构建 Windows 沙箱的实现思路,目的是让编码智能体保持可用,不必在频繁审批弹窗与整机访问权限之间二选一。官方在文中附上了说明页面链接。
推荐理由:官方拆解 Codex Windows 沙箱的实现,为编码智能体在权限审批与整机访问之间提供一种工程折中思路。


To add some clarity: you don't pay extra. It's the same subscription, same price per month. What's new our sub now covers two separate pools: · Interactive → sub limits, unchanged · Programmatic → new $20–$200 included(!!) credit, metered at API rates Community note: This is missing key context: programmatic use no longer draws from subscription limits. It uses a separate $20-$200 monthly Agent SDK credit, then extra usage is billed at standard API rates, so heavy sub users may get far less usage than before. support.claude.com/en/articles/15… platform.claude.com/docs/en/about-… support.claude.com/en/articles/12…
推荐理由:这条推文对比了 Claude Code 订阅额度调整前后规则,并估算第三方 Agent SDK 应用可用额度的缩减幅度。
Anthropic 发文说明 Claude Code 在大型代码库中的运作方式与落地实践,指出围绕模型的扩展层对实际表现的影响不亚于模型本身。文章列出五类扩展点,即 CLAUDE.md 文件、hooks、skills、plugins、MCP servers,并补充 LSP 集成和 subagents 两项能力,强调按分层顺序搭建。
推荐理由:文章拆解 Claude Code 在大代码库中的扩展层与配置模式,可作为团队规模化落地的参考路径。
阿易 AI Notes 补充了 Claude 新定价 $200/$100 背景下给实际运行 agent 用户的五条具体建议。
推荐理由:按用户类型给出算 token 消耗、席位选择与第三方工具的具体应对,可迁移到其他按量计费的 agent 场景。
Starting June 15, paid Claude plans can claim a dedicated monthly credit for programmatic usage. The credit covers usage of: - Claude Agent SDK - claude -p - Claude Code GitHub Actions - Third-party apps built on the Agent SDK
推荐理由:把订阅额度改按 API 计费的变化与重度用户的账单涨幅放在一起,便于读者重估 agent 自动化的成本。
Runway 推出 Runway Agent,一个智能体创意伙伴,可在单次对话中从想法产出可发布的成品视频,包含多镜头画面、旁白、对白和音乐。用户用自然语言描述需求,可上传参考图、选择画幅比例和时长,逐步对话确定概念与故事结构后生成视频,再用时间线编辑器做最终调整,官方称可在数分钟内产出高分辨率多镜头视频。产品面向品牌团队、营销人员、创意机构、社媒内容团队和影视创作者,现已开放使用。
推荐理由:Runway 官方宣布 Agent 上线并给出工作方式与适用场景,读者可以据此判断对话式视频生产对内容团队的适用度。
推荐理由:原文给出 Codex 用内置浏览器跨断点自测并回传截图的具体变化,读者可据此判断前端验证环节的可用性。
Anthropic 发布 Claude 计算机与浏览器使用的最佳实践,并同步开源一份封装这些做法的演示实现。文中指出 Claude 4.6 家族的 API 图像上限为长边 1568 像素、总像素 1.15MP,Opus 4.7 为 2576 像素与 3.75MP,建议截图先降采样到 1280x720(Opus 4.7 可用 1080p),并把文本指令放在图片之前。
推荐理由:文中给出的截图缩放、坐标换算与上下文管理做法,可直接用于排查并改善计算机操作的点击精度与成本。
Anthropic 推出 Claude for Small Business,一套连接器与开箱即用工作流,把 Claude 接入 Intuit Quickbooks、PayPal、HubSpot、Canva、Docusign、Google Workspace 和 Microsoft 365 等小企业常用工具。
推荐理由:面向小企业AI采用率落后于大企业的现状,Anthropic把Claude接入其常用工具并提供15个可运行的智能体工作流。
📣 What if every open issue had a Codex agent? That’s the idea behind Symphony, an open-source agent orchestrator for Codex that turns task trackers into always-on systems for agentic work, letting humans focus on review and direction. Video
推荐理由:Symphony 把任务追踪器变成常驻运行的智能体系统,读者可据此了解人机分工与编排的思路。
🚨 There's a major attack going on via npm right now. Do not install any packages right now. Talk to your agent ASAP and check if you're vulnerable or have been compromised. This is urgent ‼️
推荐理由:梳理了该供应链攻击劫持 CI 管道、使签名验证失效的机制,并给出冻结安装与轮换密钥等自查步骤。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,介绍一个基于 Gemini 的多智能体 AI 系统,可迭代生成、辩论和演化科学假说,并通过新实验工具 Hypothesis Generation 向研究者开放,可在 labs.google/science 注册。
推荐理由:原文详述了多智能体系统的生成、辩论、演化机制和多所实验室的实际应用结果,读者可以据此判断它对科研工作流的可用性。
I hope you guys understand that this is going to keep getting worse
推荐理由:梳理了这轮 npm 供应链攻击的传播链条和被绕过的签名验证,读者可据此理解 AI 开发流面临的风险。
New in Claude Code: agent view. One list of all your sessions, available today as a research preview. Video
推荐理由:原文列出了 Agent 视图的打开方式和状态标注,读者可据此判断多任务并行时如何管理多个 Agent。
Anthropic 在旧金山 Code w/ Claude 开发者大会上宣布 Claude Code 速率限制翻倍、Claude Opus 的 API 限制提高,两项调整均已生效。
推荐理由:官方公布了 Claude Code 限额调整与四项 Managed Agents 新能力,读者可据此了解云端智能体的搭建与调度方式。
Anthropic 真的惊为天人 直接把金融服务行业的 AI 工作流模板全开源了 投资银行 / 股票研究 / 私募 / 财富管理 / 基金管理 / KYC 风控 七大业务线的参考 agent / 技能包 / 数据连接器 全部公开 这超出了 demo 的范畴,是把「金融行业 AI 落地」的完整 SOP 摆出来 / 让全行业照抄 · 打开仓库 你会看到这些东西 10 个开箱即用的端到端 agent - Pitch Agent / 自动做 pitch deck(comps + 先例 + LBO → 出品牌排版的 deck) - Meeting Prep Agent / 客户会前自动出 briefing pack Market Researcher / 行业或主题 → 行业概览 + 竞争格局 + peer comps + 标的清单 - Earnings Reviewer / 财报会议 + filings → 模型更新 → 研报草稿 - Model Builder / DCF / LBO / 三表 / comps / 直接在 Excel 里建模 - Valuation Reviewer / 私募估值 + LP 报告 - GL Reconciler / 总账核对 + 找差异 + 路由审批 - Month-End Closer / 月末关账 / accruals / 滚动 / 偏差解读 - Statement Auditor / LP statement 审计 - KYC Screener / KYC 文档解析 + 规则引擎跑 + 标记缺口 每个 agent 都是 self-contained 的,带自己用到的全部 skill,clone 下来直接装 · 7 个垂直行业插件 - financial-analysis(核心):comps / DCF / LBO / 三表 / deck QC / Excel 审计 - investment-banking:CIM / teaser / 流程信 / 买方名单 / 并购模型 / 项目跟踪 - equity-research:财报笔记 / 首次覆盖 / 模型更新 / 投资逻辑跟踪 - private-equity:寻源 / 筛选 / 尽调 / IC memo / 投后监控 - wealth-management:客户复盘 / 财务规划 / 调仓 / 报告 / 税损收割 - fund-admin:GL 核对 / 差异追踪 / NAV 校验 - operations:KYC + 规则引擎 直接用 / 想改也行 / 全是 markdown + json / 没有 build 步骤 · 11 家金融数据商的 MCP 连接器 Daloopa / Morningstar / S&P Global / FactSet / Moody's MT Newswires / Aiera / LSEG / PitchBook / Chronograph / Egnyte 这一行单独值得讲 意味着 Anthropic 已经跟全球最重要的金融数据基础设施都谈完了,你接进 Claude / 这些数据全是开箱即用的,没有这些连接器 / 你自己接每一家的 API / 光人天就要好几个月 LSEG 和 S&P Global 还各自做了 partner-built 的高级插件 一个跑债券相对价值 / 利率曲线 / FX carry / 期权波动率 / 宏观利率监控 一个跑 tear sheet / 财报预览 / 融资 digest · 部署方式两种,一个仓库 方式一:Claude Cowork 插件 装在分析师电脑上 / 个人工作流 方式二:Claude Managed Agents API 跑在公司自己的工作流引擎后面 / 整个公司用 同一份 system prompt / 同一份 skill / 你选在哪儿跑 还附带一个 Microsoft 365 安装工具,让公司 IT admin 把 Claude 部署进 Excel / PowerPoint / Word / Outlook 而且可以走你公司自己的云(Vertex AI / Bedrock / 内部 LLM gateway),不强制走 Anthropic API · 金融是企业 AI 落地最大也最难啃的市场,合规要求高 / 数据敏感 / 流程复杂 Anthropic 这一手 直接把整个行业的 AI 落地 SOP 写明白了 谁照这套搭 / 谁就在 Claude 的轨道上长 谁不照这套搭 / 谁要从零开始踩半年坑 最值得对比的是 OpenAI OpenAI 上周刚上线广告平台 Anthropic 这周直接开源金融行业全套 agent 两家公司的路线分化在这种地方又看得清清楚楚 OpenAI = 大众消费 + 广告 Anthropic = 企业场景 + 开源行业模板 链接 github.com/anthropics/financ…
推荐理由:Anthropic 开源金融行业 agent 模板与数据商 MCP 连接器,可看到企业级落地的整套结构与部署选项。
Anthropic 宣布 Claude Platform on AWS 正式可用,AWS 客户可通过 AWS IAM 认证、CloudTrail 审计和单一 AWS 账单接入完整的 Claude API 功能,新功能和 beta 与原生 API 同日上线。
推荐理由:Anthropic 把完整 Claude API 搬到 AWS,读者可据此比较它与 Bedrock 在运营方和功能覆盖上的差别。
Claude Code 推出 agent view,可在同一处管理所有 Claude Code 会话。用户按左方向键或运行 claude agents 打开该视图,每行显示会话状态、最后回复内容和最近交互时间,选中会话即可查看并直接回复。
推荐理由:原文给出了并行会话的查看、回复与后台化入口,读者可据此判断多智能体并行工作流的组织方式。
Introducing GPT-Realtime-2 in the API: our most intelligent voice model yet, bringing GPT-5-class reasoning to voice agents. Voice agents are now real-time collaborators that can listen, reason, and solve complex problems as conversations unfold. Now available in the API alongside streaming models GPT-Realtime-Translate and GPT-Realtime-Whisper — a new set of audio capabilities for the next generation of voice interfaces. Video
推荐理由:Genspark 给出了接入 GPT-Realtime-2 后自家语音智能体的通话指标变化,可用来观察语音智能体在真实通话场景中的提升幅度。
推荐理由:Codex 接入 Chrome 后可跨标签页并行运行,读者能借此了解浏览器内编码智能体的工作方式变化。