Slack 如何构建人类与智能体团队:把对话变成知识
Slack 首席产品官 Jaime Delanghe 分享构建人类与智能体团队的最佳实践:默认使用公开频道,让 Claude 智能体能够读取对话、决策与工作进展,并将其转化为组织知识。智能体负责起草、总结、监控等生产性工作,人类负责审核、决策与重新分配,形成循环交接。她还建议为智能体设定清晰角色,让价值被感知而非被强制推行。
claude.com · 网站与博客
Slack 首席产品官 Jaime Delanghe 分享构建人类与智能体团队的最佳实践:默认使用公开频道,让 Claude 智能体能够读取对话、决策与工作进展,并将其转化为组织知识。智能体负责起草、总结、监控等生产性工作,人类负责审核、决策与重新分配,形成循环交接。她还建议为智能体设定清晰角色,让价值被感知而非被强制推行。
ABC Legal 为 1,100 名员工部署 Claude Enterprise 后,又用 Claude Managed Agents 把智能体统一托管到云端,截至 2026 年 7 月已有 50+ 个智能体投入生产,约 310 名员工日常使用 Claude。
Anthropic 发布 Claude 成本可见性与控制指南,介绍 IT 管理员在 Claude Enterprise 中可用的成本管控手段,包括访问门控、模型权限与默认值、硬性支出上限,以及按人员、团队和模型拆分的用量分析、数据导出和 Analytics API。
MCP 第五个规范版本 MCP 2026-07-28 发布,协议核心从有状态双向模型改为请求/响应无状态模型,并纳入 MCP Apps 与 Tasks 标准化扩展,授权对齐生产环境的 OAuth 2.0 与 OIDC。
推荐理由:MCP 2026-07-28 把协议核心改为无状态并引入扩展框架,读者可据此判断服务器部署与扩展方式的变化。
Claude 的 Compliance API 现已覆盖桌面、网页和移动端的 Cowork,以及 CLI 和桌面端的 Claude Code,面向 Claude Enterprise 客户开放 beta。
Claude Code 的自动模式现已改为默认设置,由分类器评估每个待执行动作并拦截可能有害的命令,取代逐条人工批准权限提示。Anthropic 称内部评估中分类器发现的危险操作多于开发者手动点击批准时,且在第三方红队测试下表现稳定;由于会话打断更少,Claude 在两次中断之间的连续工作时间是此前默认设置的 9 倍。
推荐理由:官方给出自动模式在 Nuro、Gusto、Garner Health 生产环境的落地细节,可了解分类器在速度与安全之间的取舍。
Anthropic 为 Claude Tag 更新上下文能力,Claude 现在会读取整个 Slack 频道的消息,并结合自身记忆与用户设定的常驻指令判断何时主动发言,官方称其在判断该不该主动响应上提升约 30%。
Anthropic 为 Claude Code 推出自托管环境公测,会话可在企业自有网络内的基础设施上运行,并访问内部服务、数据库和注册表。仓库检出、构建产物和密钥都留在自有基础设施,但提示词、回复和工具结果仍会发送到 Anthropic 做推理,会话记录也会被存储以便从任意入口继续。
Claude Code 官方博客解释了会话的 token 成本构成,输出 token 单价约为输入的 5 倍,缓存读取按输入价的 0.1 倍计价、写入最高为 2 倍。
推荐理由:官方拆解了 prompt 缓存与上下文如何影响会话成本,并给出可直接照做的会话管理方式。
JetBrains CTO Vladislav Tankov 披露,Claude Fable 5 在其私有仓库评测中 Python 通过率达 44.3%,比 Opus 4.8 的 28.2% 高出 16 个百分点,且解题步骤少约 22%。
Anthropic 数据团队撰文说明如何在 Slack 部署 Claude Tag 做自助数据分析,关键做法是把技能文件当作持续刷新的服务端内容,每次对话重新读取。
Claude 在 Chrome 的侧边栏会话已改为 Claude Cowork 会话,对话会保存到历史记录,技能和连接器可在浏览器中使用,在标签页里开始的任务能在桌面端、网页端和移动端接续完成。
推荐理由:官方说明了侧边栏会话与多端打通后的连续工作方式,也交代了浏览器智能体面临的提示词注入风险和新增的动作检查。
Anthropic 业务拓展团队将销售收件箱、外呼调研等流程搭建成 Claude Cowork 中的技能与定时任务,原本每天约 5 小时的手动回复改为由技能每小时扫描收件箱并生成待审草稿。
Anthropic 宣布从 8 月 14 日起 Claude Code 在 Pro、Max 和 Team 计划的新会话默认启用 auto mode,并停止向这些计划用户收取分类器开销。
推荐理由:文中对照了 auto mode 与人工审批在拦截危险命令上的差异,读者可据此判断默认权限模式的取舍。
Anthropic 正与 Millennium 合作共建数字风险分析师,一个在该公司风险经理监督下工作的 AI 队友,用于挖掘风险洞察并形成跨资产类别的风险敞口判断。
Anthropic 为 Claude Enterprise 推出 Inference hooks,可在提示词和工具调用响应到达 Claude 前由企业 DLP 服务器实时判定放行或拦截。
Anthropic 为 Claude Opus 5、Claude Fable 5 等新代模型删掉了 Claude Code 超过 80% 的系统提示词,编码评测未出现可测损失。
推荐理由:文中给出系统提示词、CLAUDE.md 与 Skill 的简化方向,可对照调整自家 Agent 的上下文组织方式。
Anthropic 产品设计师 Nate Parrott 撰文介绍自己如何用 Claude Design 在正式构建前探索和迭代视觉想法,从交互原型、幻灯片到动画。
推荐理由:作者作为 Claude Design 的设计者,记录了从想法到视觉稿的实际用法和提示词习惯,可供设计流程参考。
Anthropic 发文解析 Claude 模型家族 Mythos / Fable、Opus、Sonnet、Haiku 的定位与选型方法,默认建议从最智能的通用可用模型起步,再用 effort level 调节性能与成本。
Anthropic 将 Claude 认证计划扩展为四类按角色划分的认证,新增 Claude Certified Associate: Foundations。
Claude 语音模式现已运行在 Claude Opus、Sonnet 和 Haiku 上,可调用 Gmail、Slack 等已连接工具,并新增法语、德语、印地语、日语、韩语等多种语言。
推荐理由:语音模式此前只跑 Haiku,如今接入 Opus 和 Sonnet 并打通已连接工具,让口头推演能直接落到执行。
Claude Code 团队成员撰文介绍如何用 skills 在 Claude Code 中构建验证循环,可以先用 skill-creator 插件或手写 SKILL.md 把重复检查固化成 skill。
推荐理由:文章给出把验证步骤写成 skill 的四种挂载方式并附示例文件,可作为搭建自动化验证流程的参考。
Outtake 基于 Claude 分四阶段构建了网络安全调查智能体 Recon Agent:先在 Claude Code 中原型验证,再迁移到 Claude Agent SDK 投入生产,并从一开始就集成 agent evals 形成快速迭代闭环。
Datadog 团队构建了 Temper,一个让智能体产出规格说明而非应用代码的运行时环境,内核读取规格、经四层分析验证后直接部署其描述的系统。每份规格由 Behavior、Data contract、Authorization 三类契约描述,并分别经过符号推理、穷尽状态探索、带种子故障注入的确定性仿真和随机属性测试,小规格的整条验证链在不到一秒内跑完。
Rakuten 自 2025 年 3 月起用 Claude Code 加速软件开发,并在一周内将 Claude Managed Agents 部署到产品、销售、营销和财务等部门,各领域任务处理速度提升约 10 倍。测试 Claude Fable 5 时,该模型能长时间自主运行、边执行边自我验证,让 Kaji 团队首次可将整项任务而非细分步骤交给智能体,并在无人值守下过夜完成。
Claude Fable 5 在 Cursor 自建评测 CursorBench 上以 Max effort 取得 72.9% 的新高分。CursorBench 用真实开发者那种模糊提示考察模型,例如只粘贴一段 stack trace 加一个"fix",模型需自行推断意图、定位根因并验证修改。
Anthropic 教育团队发布指南,介绍在 Claude Cowork 中如何使用 Claude Fable 5 完成长周期复杂任务。Fable 5 并非 Claude Cowork 的默认模型,需手动选择,当前默认为 Claude Sonnet 5;它带有新的分类器,检测到网络安全或生物化学相关滥用时会自动改由 Claude Opus 4.8 处理并告知用户。
Anthropic 分享了用 Claude Code 做大规模代码迁移的六步流程,从规则手册、依赖映射、缺口清单,到压力测试、全量翻译与编译运行,核心是 implement、review、fix 的多智能体循环。
推荐理由:Anthropic 公开了用多智能体循环做大规模代码迁移的完整流程,其中的规则手册与对抗式评审可迁移到其他跨语言迁移项目。
Base44 将此前只交给资深工程师的核心工程任务——重建其系统提示词——交由 Claude Fable 5 完成,模型自主运行四小时后交付了 90% 至 95% 的所需结果,团队当天下午即通过 A/B 测试上线。
Hebbia 用 Claude Fable 5 跑其金融专用基准测试,在财务文档问答与引用查找上取得约 20% 的相对准确率提升,为团队迄今测得的最大幅度。该模型还能在智能体测试中一次性处理多部分请求并逐条回溯引用来源,并支持 Matrix 承担信贷协议条款提取、风险标记到备忘录初稿的多步分析。
Cognition 在自建 Frontier Code 基准上测得 Claude Fable 5 最难子集得分约 30%,此前 Opus 模型仅约 10%。Claude Fable 5 是首个能正确使用 Cognition 内部调试工具的模型,可连续自主工作八小时并保持进展,让 Devin 的云端长时智能体设想变得可行。
Anthropic 营销运营团队用 Claude Cowork 将每周营销指标报告从 1-2 天压缩到最多 2 小时,活动搭建也由 Claude 接管。Ian Chan 搭建了准备、校对、行动项三个技能,周日定时任务自动读取会议记录、查询数据仓库并生成报告;Annabel Custer 则用调度技能加五个专家技能处理活动搭建与数据导入请求。
Thomson Reuters 基于 Claude 及 Claude Agent SDK 重建法律 AI 平台 CoCounsel Legal,让单一智能体可同时调用数百个公司工具,实时规划、委派并编排跨工具与内容源的任务。其法律研究原本需数十小时,现可在数分钟内给出可核验的起点,系统会校验引用来源,客户数据不用于训练第三方模型。
Claude Code 团队技术成员 Lydia Hallie 发文解释,Claude Code 会把系统提示、工具定义、CLAUDE.md、对话历史和上下文文件打包成一次 API 请求,而 effort 等级决定 Claude 每轮愿意投入多少工作。
Claude Code 和 Claude Cowork 现已在 Claude for Government Desktop 中开启公开测试,运行于 FedRAMP High 授权环境,对话历史存储在机构本地设备上。Claude Cowork 可直接处理桌面文件,用于起草备忘录、审阅 RFP、案件处理和演示文稿。管理员可按部门分配席位与预算,审计日志采用哈希链记录,敏感操作需双人审批。
Claude Cowork 正在登陆移动端与网页端,测试版将在未来几周内从 Max 用户开始逐步开放。网页端可从 claude.ai 首页启动 Cowork 会话,移动端可从 iOS 和 Android 版 Claude 应用侧边栏进入,桌面端仍支持本地文件与浏览器。
Anthropic 抽样分析 2026 年 5 月 11 日至 31 日的 120 万条 Claude Cowork 会话,按 20 类工作分类。占比最高的是业务流程与运营,达 33.4%,其次为内容创作与文案 16.4%,软件开发仅 8.7%。Claude Cowork 面向所有 Claude 用户开放,主要承担跨角色的信息整合与沟通类工作。
Anthropic 技术人员 Thariq Shihipar 发布 Claude Fable 5 使用指南,提出用提示词让 Claude 帮自己发现未考虑到的信息。文章把未知信息分为已知的已知、已知的未知、未知的已知和未知的未知四类,并给出 blind spot pass、头脑风暴与原型、访谈、代码参考、实施计划、实施笔记、讲解文档和测验等模式及对应示例提示词。
推荐理由:作者把发现未考虑到的信息拆成一套可复用的提示词模式,读者能直接照着改善与 Claude 的协作。
Anthropic 为 Claude Enterprise 新增管理员分析面板、模型级权限和支出预警,可按 SCIM 分组和用户查看用量与成本。Claude Code 新增 usage 与 value 两个标签页,展示活跃开发者、会话数、每次提交成本等指标。
Claude 官方博客发布 Claude Code 循环工程入门指南,把智能体循环分为回合制、目标驱动、时间驱动和主动式四类,并说明各自的触发方式、停止条件与适用场景。
推荐理由:面向 Claude Code 的四类循环原语入门,给出各自的停止条件与 token 控制建议,方便按现有任务挑选合适的循环。