推荐理由:原文给出 Codex 用内置浏览器跨断点自测并回传截图的具体变化,读者可据此判断前端验证环节的可用性。
Agent 智能体
全部主题让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。
最新精选
第 301–320 条 · 共 348 条@JamesZmSun@jameszmsun精选AI 评分6565 
Claude Blog精选AI 评分7272 Claude 计算机与浏览器使用的最佳实践
Anthropic 发布 Claude 计算机与浏览器使用的最佳实践,并同步开源一份封装这些做法的演示实现。文中指出 Claude 4.6 家族的 API 图像上限为长边 1568 像素、总像素 1.15MP,Opus 4.7 为 2576 像素与 3.75MP,建议截图先降采样到 1280x720(Opus 4.7 可用 1080p),并把文本指令放在图片之前。
推荐理由:文中给出的截图缩放、坐标换算与上下文管理做法,可直接用于排查并改善计算机操作的点击精度与成本。
Anthropic Newsroom精选AI 评分6464 Anthropic 推出 Claude for Small Business
Anthropic 推出 Claude for Small Business,一套连接器与开箱即用工作流,把 Claude 接入 Intuit Quickbooks、PayPal、HubSpot、Canva、Docusign、Google Workspace 和 Microsoft 365 等小企业常用工具。
推荐理由:面向小企业AI采用率落后于大企业的现状,Anthropic把Claude接入其常用工具并提供15个可运行的智能体工作流。
@OpenAIDevs@openaidevs精选AI 评分6969 引用OpenAI Developers (@OpenAIDevs)@OpenAIDevs📣 What if every open issue had a Codex agent? That’s the idea behind Symphony, an open-source agent orchestrator for Codex that turns task trackers into always-on systems for agentic work, letting humans focus on review and direction. Video
推荐理由:Symphony 把任务追踪器变成常驻运行的智能体系统,读者可据此了解人机分工与编排的思路。
@AYi_AInotes@ayi_ainotes精选AI 评分6666
引用Ryan Carson (@ryancarson)@ryancarson🚨 There's a major attack going on via npm right now. Do not install any packages right now. Talk to your agent ASAP and check if you're vulnerable or have been compromised. This is urgent ‼️
推荐理由:梳理了该供应链攻击劫持 CI 管道、使签名验证失效的机制,并给出冻结安装与轮换密钥等自查步骤。
Google DeepMind精选AI 评分6969 Google DeepMind 发布基于 Gemini 的多智能体系统 Co-Scientist 并开放注册
Google DeepMind 在 Nature 发表 Co-Scientist 研究,介绍一个基于 Gemini 的多智能体 AI 系统,可迭代生成、辩论和演化科学假说,并通过新实验工具 Hypothesis Generation 向研究者开放,可在 labs.google/science 注册。
推荐理由:原文详述了多智能体系统的生成、辩论、演化机制和多所实验室的实际应用结果,读者可以据此判断它对科研工作流的可用性。
@AYi_AInotes@ayi_ainotes精选AI 评分7676
引用Theo - t3.gg (@theo)@theoI hope you guys understand that this is going to keep getting worse
推荐理由:梳理了这轮 npm 供应链攻击的传播链条和被绕过的签名验证,读者可据此理解 AI 开发流面临的风险。
@op7418@op7418精选AI 评分6666
引用Claude (@claudeai)@claudeaiNew in Claude Code: agent view. One list of all your sessions, available today as a research preview. Video
推荐理由:原文列出了 Agent 视图的打开方式和状态标注,读者可据此判断多任务并行时如何管理多个 Agent。
Claude Blog精选AI 评分6262 Anthropic 回顾 Code w/ Claude SF 2026,Claude Managed Agents 新增四项功能
Anthropic 在旧金山 Code w/ Claude 开发者大会上宣布 Claude Code 速率限制翻倍、Claude Opus 的 API 限制提高,两项调整均已生效。
推荐理由:官方公布了 Claude Code 限额调整与四项 Managed Agents 新能力,读者可据此了解云端智能体的搭建与调度方式。
@frxiaobei@frxiaobei精选AI 评分6969 引用Jason Zhu (@GoSailGlobal)@GoSailGlobalAnthropic 真的惊为天人 直接把金融服务行业的 AI 工作流模板全开源了 投资银行 / 股票研究 / 私募 / 财富管理 / 基金管理 / KYC 风控 七大业务线的参考 agent / 技能包 / 数据连接器 全部公开 这超出了 demo 的范畴,是把「金融行业 AI 落地」的完整 SOP 摆出来 / 让全行业照抄 · 打开仓库 你会看到这些东西 10 个开箱即用的端到端 agent - Pitch Agent / 自动做 pitch deck(comps + 先例 + LBO → 出品牌排版的 deck) - Meeting Prep Agent / 客户会前自动出 briefing pack Market Researcher / 行业或主题 → 行业概览 + 竞争格局 + peer comps + 标的清单 - Earnings Reviewer / 财报会议 + filings → 模型更新 → 研报草稿 - Model Builder / DCF / LBO / 三表 / comps / 直接在 Excel 里建模 - Valuation Reviewer / 私募估值 + LP 报告 - GL Reconciler / 总账核对 + 找差异 + 路由审批 - Month-End Closer / 月末关账 / accruals / 滚动 / 偏差解读 - Statement Auditor / LP statement 审计 - KYC Screener / KYC 文档解析 + 规则引擎跑 + 标记缺口 每个 agent 都是 self-contained 的,带自己用到的全部 skill,clone 下来直接装 · 7 个垂直行业插件 - financial-analysis(核心):comps / DCF / LBO / 三表 / deck QC / Excel 审计 - investment-banking:CIM / teaser / 流程信 / 买方名单 / 并购模型 / 项目跟踪 - equity-research:财报笔记 / 首次覆盖 / 模型更新 / 投资逻辑跟踪 - private-equity:寻源 / 筛选 / 尽调 / IC memo / 投后监控 - wealth-management:客户复盘 / 财务规划 / 调仓 / 报告 / 税损收割 - fund-admin:GL 核对 / 差异追踪 / NAV 校验 - operations:KYC + 规则引擎 直接用 / 想改也行 / 全是 markdown + json / 没有 build 步骤 · 11 家金融数据商的 MCP 连接器 Daloopa / Morningstar / S&P Global / FactSet / Moody's MT Newswires / Aiera / LSEG / PitchBook / Chronograph / Egnyte 这一行单独值得讲 意味着 Anthropic 已经跟全球最重要的金融数据基础设施都谈完了,你接进 Claude / 这些数据全是开箱即用的,没有这些连接器 / 你自己接每一家的 API / 光人天就要好几个月 LSEG 和 S&P Global 还各自做了 partner-built 的高级插件 一个跑债券相对价值 / 利率曲线 / FX carry / 期权波动率 / 宏观利率监控 一个跑 tear sheet / 财报预览 / 融资 digest · 部署方式两种,一个仓库 方式一:Claude Cowork 插件 装在分析师电脑上 / 个人工作流 方式二:Claude Managed Agents API 跑在公司自己的工作流引擎后面 / 整个公司用 同一份 system prompt / 同一份 skill / 你选在哪儿跑 还附带一个 Microsoft 365 安装工具,让公司 IT admin 把 Claude 部署进 Excel / PowerPoint / Word / Outlook 而且可以走你公司自己的云(Vertex AI / Bedrock / 内部 LLM gateway),不强制走 Anthropic API · 金融是企业 AI 落地最大也最难啃的市场,合规要求高 / 数据敏感 / 流程复杂 Anthropic 这一手 直接把整个行业的 AI 落地 SOP 写明白了 谁照这套搭 / 谁就在 Claude 的轨道上长 谁不照这套搭 / 谁要从零开始踩半年坑 最值得对比的是 OpenAI OpenAI 上周刚上线广告平台 Anthropic 这周直接开源金融行业全套 agent 两家公司的路线分化在这种地方又看得清清楚楚 OpenAI = 大众消费 + 广告 Anthropic = 企业场景 + 开源行业模板 链接 github.com/anthropics/financ…
推荐理由:Anthropic 开源金融行业 agent 模板与数据商 MCP 连接器,可看到企业级落地的整套结构与部署选项。
Claude Blog精选AI 评分6262 Claude Platform on AWS 正式可用,完整 Claude API 功能接入 AWS
Anthropic 宣布 Claude Platform on AWS 正式可用,AWS 客户可通过 AWS IAM 认证、CloudTrail 审计和单一 AWS 账单接入完整的 Claude API 功能,新功能和 beta 与原生 API 同日上线。
推荐理由:Anthropic 把完整 Claude API 搬到 AWS,读者可据此比较它与 Bedrock 在运营方和功能覆盖上的差别。
Claude Blog精选AI 评分6262 Claude Code 推出 agent view,集中管理多个并行会话
Claude Code 推出 agent view,可在同一处管理所有 Claude Code 会话。用户按左方向键或运行 claude agents 打开该视图,每行显示会话状态、最后回复内容和最近交互时间,选中会话即可查看并直接回复。
推荐理由:原文给出了并行会话的查看、回复与后台化入口,读者可据此判断多智能体并行工作流的组织方式。
@genspark_ai@genspark_ai精选AI 评分7474 引用OpenAI (@OpenAI)@OpenAIIntroducing GPT-Realtime-2 in the API: our most intelligent voice model yet, bringing GPT-5-class reasoning to voice agents. Voice agents are now real-time collaborators that can listen, reason, and solve complex problems as conversations unfold. Now available in the API alongside streaming models GPT-Realtime-Translate and GPT-Realtime-Whisper — a new set of audio capabilities for the next generation of voice interfaces. Video
推荐理由:Genspark 给出了接入 GPT-Realtime-2 后自家语音智能体的通话指标变化,可用来观察语音智能体在真实通话场景中的提升幅度。
@OpenAI@openai精选AI 评分6969 
推荐理由:Codex 接入 Chrome 后可跨标签页并行运行,读者能借此了解浏览器内编码智能体的工作方式变化。
@TencentHunyuan@tencenthunyuan精选AI 评分6969 


推荐理由:官方公布 Hy3 preview 上线两周后的 OpenRouter 用量与排名,可据此观察开发者对其的采用速度。
Google DeepMind精选AI 评分6767 Google DeepMind 发布 AlphaEvolve 一年成果汇总:从基因测序优化到下一代 TPU 设计
Google DeepMind 发布 AlphaEvolve 一周年成果汇总,介绍这款 Gemini 驱动的算法设计智能体在各领域的落地成果。
推荐理由:官方汇总了 AlphaEvolve 一年来在科研、基础设施和商业场景的具体成果与数字,读者可据此评估算法发现型 Agent 的落地范围。
Anthropic Newsroom精选AI 评分6363 Anthropic 发布十款金融服务智能体模板并接入 Microsoft 365
Anthropic 发布十款面向金融服务的开箱即用智能体模板,覆盖 pitchbook 制作、KYC 筛查和月末结账等耗时工作,以 Claude Cowork、Claude Code 插件及 Claude Managed Agents 的 cookbook 形式提供。
推荐理由:原文给出了十类金融智能体模板的构成与接入方式,读者可据此判断其在投研与合规流程中的落地路径。
Sierra Blog精选AI 评分6464 Sierra 发布 𝜏-voice 基准,在真实语音条件下评测实时语音 Agent
Sierra 团队推出 𝜏-voice 基准,将 𝜏-bench 的 278 个客服任务与全双工实时语音、可控真实音频结合,任务、工具和评估器与文本版逐字节一致,语音成绩可与文本 Agent 直接对比。
推荐理由:语音与文本能力可在同一套任务上直接对比,还给出了噪音与口音下各厂商的具体失败模式。
Claude Blog精选AI 评分6464 构建 Claude Code 的经验:提示词缓存决定一切
Claude Code 团队发文总结围绕提示词缓存构建智能体的工程经验,核心是提示词缓存按前缀匹配,前缀中任何改动都会使其后的缓存失效,因此要把静态内容放前面、动态内容放后面。
推荐理由:Claude Code 团队公开了围绕提示词缓存设计智能体的具体取舍,可迁移到自建 Agent 的提示词组织与工具管理。
Hugging Face Blog精选AI 评分8080 NVIDIA 发布 Nemotron 3 Nano Omni 长上下文多模态模型
NVIDIA 发布开源全能多模态理解模型 Nemotron 3 Nano Omni 30B-A3B,在 OCRBenchV2-En 得分 65.8、MMLongBench-Doc 57.5,并新增音频与视频理解能力。
推荐理由:原文列出文档、视频与音频榜单成绩及吞吐对比,读者可据此判断该开源全能模型的能力边界。