跳到正文

Agent 智能体

让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。

最新精选

第 241–260 条 · 共 282 条
5月12日周二
  1. @AYi_AInotes76

    Mini Shai-Hulud 供应链攻击已从 TanStack 扩散至 UiPath、Mistral AI 相关包,共 205 个制品被毒化,攻击者在 6 分钟内发布 84 个恶意版本,Socket 在 6 分钟内全部标记。

    引用Theo - t3.gg (@theo)@theo

    I hope you guys understand that this is going to keep getting worse

    推荐理由:梳理了这轮 npm 供应链攻击的传播链条和被绕过的签名验证,读者可据此理解 AI 开发流面临的风险。

  2. @op741866

    Claude Code 新增 Agent 视图功能,可在单个终端标签页里管理多个正在运行的 Agent,并标注已完成、需要输入、正在进行等状态。该功能以研究预览形式开放,可通过任意会话点按左箭头或运行 `claude agents` 打开,用 `/bg` 命令可将现有会话加入视图。在视图中每一行代表一个 Agent,可查看对话详情并直接回复。

    引用Claude (@claudeai)@claudeai

    New in Claude Code: agent view. One list of all your sessions, available today as a research preview. Video

    推荐理由:原文列出了 Agent 视图的打开方式和状态标注,读者可据此判断多任务并行时如何管理多个 Agent。

5月11日周一
  1. @frxiaobei69

    Anthropic 开源了面向金融服务行业的 AI 工作流模板,覆盖投资银行、股票研究、私募、财富管理、基金管理和 KYC 风控等业务线,包含 10 个端到端 agent、7 个垂直行业插件以及 11 家金融数据商的 MCP 连接器。仓库内容为 markdown 与 json,无 build 步骤,可通过 Claude Cowork 插件或 Claude Managed Agents API 部署。作者认为这相当于把金融行业 AI 落地的完整 SOP 摆上台面。

    引用Jason Zhu (@GoSailGlobal)@GoSailGlobal

    Anthropic 真的惊为天人 直接把金融服务行业的 AI 工作流模板全开源了 投资银行 / 股票研究 / 私募 / 财富管理 / 基金管理 / KYC 风控 七大业务线的参考 agent / 技能包 / 数据连接器 全部公开 这超出了 demo 的范畴,是把「金融行业 AI 落地」的完整 SOP 摆出来 / 让全行业照抄 · 打开仓库 你会看到这些东西 10 个开箱即用的端到端 agent - Pitch Agent / 自动做 pitch deck(comps + 先例 + LBO → 出品牌排版的 deck) - Meeting Prep Agent / 客户会前自动出 briefing pack Market Researcher / 行业或主题 → 行业概览 + 竞争格局 + peer comps + 标的清单 - Earnings Reviewer / 财报会议 + filings → 模型更新 → 研报草稿 - Model Builder / DCF / LBO / 三表 / comps / 直接在 Excel 里建模 - Valuation Reviewer / 私募估值 + LP 报告 - GL Reconciler / 总账核对 + 找差异 + 路由审批 - Month-End Closer / 月末关账 / accruals / 滚动 / 偏差解读 - Statement Auditor / LP statement 审计 - KYC Screener / KYC 文档解析 + 规则引擎跑 + 标记缺口 每个 agent 都是 self-contained 的,带自己用到的全部 skill,clone 下来直接装 · 7 个垂直行业插件 - financial-analysis(核心):comps / DCF / LBO / 三表 / deck QC / Excel 审计 - investment-banking:CIM / teaser / 流程信 / 买方名单 / 并购模型 / 项目跟踪 - equity-research:财报笔记 / 首次覆盖 / 模型更新 / 投资逻辑跟踪 - private-equity:寻源 / 筛选 / 尽调 / IC memo / 投后监控 - wealth-management:客户复盘 / 财务规划 / 调仓 / 报告 / 税损收割 - fund-admin:GL 核对 / 差异追踪 / NAV 校验 - operations:KYC + 规则引擎 直接用 / 想改也行 / 全是 markdown + json / 没有 build 步骤 · 11 家金融数据商的 MCP 连接器 Daloopa / Morningstar / S&P Global / FactSet / Moody's MT Newswires / Aiera / LSEG / PitchBook / Chronograph / Egnyte 这一行单独值得讲 意味着 Anthropic 已经跟全球最重要的金融数据基础设施都谈完了,你接进 Claude / 这些数据全是开箱即用的,没有这些连接器 / 你自己接每一家的 API / 光人天就要好几个月 LSEG 和 S&P Global 还各自做了 partner-built 的高级插件 一个跑债券相对价值 / 利率曲线 / FX carry / 期权波动率 / 宏观利率监控 一个跑 tear sheet / 财报预览 / 融资 digest · 部署方式两种,一个仓库 方式一:Claude Cowork 插件 装在分析师电脑上 / 个人工作流 方式二:Claude Managed Agents API 跑在公司自己的工作流引擎后面 / 整个公司用 同一份 system prompt / 同一份 skill / 你选在哪儿跑 还附带一个 Microsoft 365 安装工具,让公司 IT admin 把 Claude 部署进 Excel / PowerPoint / Word / Outlook 而且可以走你公司自己的云(Vertex AI / Bedrock / 内部 LLM gateway),不强制走 Anthropic API · 金融是企业 AI 落地最大也最难啃的市场,合规要求高 / 数据敏感 / 流程复杂 Anthropic 这一手 直接把整个行业的 AI 落地 SOP 写明白了 谁照这套搭 / 谁就在 Claude 的轨道上长 谁不照这套搭 / 谁要从零开始踩半年坑 最值得对比的是 OpenAI OpenAI 上周刚上线广告平台 Anthropic 这周直接开源金融行业全套 agent 两家公司的路线分化在这种地方又看得清清楚楚 OpenAI = 大众消费 + 广告 Anthropic = 企业场景 + 开源行业模板 链接 github.com/anthropics/financ…

    推荐理由:Anthropic 开源金融行业 agent 模板与数据商 MCP 连接器,可看到企业级落地的整套结构与部署选项。

  2. Claude Blog62

    Claude Code 推出 agent view,集中管理多个并行会话

    Claude Code 推出 agent view,可在同一处管理所有 Claude Code 会话。用户按左方向键或运行 claude agents 打开该视图,每行显示会话状态、最后回复内容和最近交互时间,选中会话即可查看并直接回复。

    推荐理由:原文给出了并行会话的查看、回复与后台化入口,读者可据此判断多智能体并行工作流的组织方式。

5月8日周五
  1. @genspark_ai74

    Genspark 宣布 GPT-Realtime-2 已上线其平台,Call for Me Agent 现已运行在该模型上,Genspark Realtime Voice 也将随后升级。官方称其带来更清晰的推理、更严格的指令遵循,有效通话率提升 26%,掉线明显减少。OpenAI 同时在 API 中提供 GPT-Realtime-2,与流式模型 GPT-Realtime-Translate 和 GPT-Realtime-Whisper 一同上线。

    引用OpenAI (@OpenAI)@OpenAI

    Introducing GPT-Realtime-2 in the API: our most intelligent voice model yet, bringing GPT-5-class reasoning to voice agents. Voice agents are now real-time collaborators that can listen, reason, and solve complex problems as conversations unfold. Now available in the API alongside streaming models GPT-Realtime-Translate and GPT-Realtime-Whisper — a new set of audio capabilities for the next generation of voice interfaces. Video

    推荐理由:Genspark 给出了接入 GPT-Realtime-2 后自家语音智能体的通话指标变化,可用来观察语音智能体在真实通话场景中的提升幅度。

5月6日周三
  1. @TencentHunyuan69

    腾讯混元 Hy3 preview 发布两周后登上 OpenRouter 周榜第一,处理 3.66T tokens,周环比增长 298%。在总用量、工具调用和编码三项均列第一,占所有提供商 15.4% 的市场份额。使用它的主要应用包括 Hermes Agent、Claude Code、Kilo Code、OpenClaw 和 Cline。

    推荐理由:官方公布 Hy3 preview 上线两周后的 OpenRouter 用量与排名,可据此观察开发者对其的采用速度。

5月5日周二
  1. Anthropic Newsroom63

    Anthropic 发布十款金融服务智能体模板并接入 Microsoft 365

    Anthropic 发布十款面向金融服务的开箱即用智能体模板,覆盖 pitchbook 制作、KYC 筛查和月末结账等耗时工作,以 Claude Cowork、Claude Code 插件及 Claude Managed Agents 的 cookbook 形式提供。

    推荐理由:原文给出了十类金融智能体模板的构成与接入方式,读者可据此判断其在投研与合规流程中的落地路径。

5月2日周六
  1. Sierra Blog64

    Sierra 发布 𝜏-voice 基准,在真实语音条件下评测实时语音 Agent

    Sierra 团队推出 𝜏-voice 基准,将 𝜏-bench 的 278 个客服任务与全双工实时语音、可控真实音频结合,任务、工具和评估器与文本版逐字节一致,语音成绩可与文本 Agent 直接对比。

    推荐理由:语音与文本能力可在同一套任务上直接对比,还给出了噪音与口音下各厂商的具体失败模式。

4月30日周四
  1. Claude Blog64

    构建 Claude Code 的经验:提示词缓存决定一切

    Claude Code 团队发文总结围绕提示词缓存构建智能体的工程经验,核心是提示词缓存按前缀匹配,前缀中任何改动都会使其后的缓存失效,因此要把静态内容放前面、动态内容放后面。

    推荐理由:Claude Code 团队公开了围绕提示词缓存设计智能体的具体取舍,可迁移到自建 Agent 的提示词组织与工具管理。

4月28日周二
  1. inclusionAI Hugging Face models62

    inclusionAI 发布 DR-Venus-4B-SFT 深度研究智能体模型

    inclusionAI 发布 4B 深度研究智能体 DR-Venus-4B-SFT,基于 Qwen3-4B-Thinking-2507 在清洗后的开源 REDSearcher 轨迹上做智能体监督微调,最大训练长度 200K,使用 search 与 visit 工具。

    推荐理由:给出 9B 以下开源深研究智能体的基准对比,读者可据此判断 4B 模型的深研究能力位置。

  2. Claude Blog65

    华盛顿大学 MacCoss 实验室用新开发者入职法让 Claude Code 接管 70 万行遗留代码

    华盛顿大学 MacCoss 实验室的 Brendan MacLean 将17年培养新开发者的入职方法应用于 Claude Code,把 AI 上下文放入独立仓库 pwiz-ai,用 CLAUDE.md、技能库和 MCP 集成管理 70 万行 C# 的 Skyline 代码库。

    推荐理由:原文给出维护17年、70万行C#代码库的上下文分层和技能库方法,对长期项目接入 Claude Code 有可迁移的参考。