拆解 Anthropic:战略聚焦与组织文化如何带来后来居上
Founder Park 转载「海外独角兽」的文章,从战略和组织两个角度拆解 Anthropic,认为聚焦 coding、坚持 scaling laws 与使命驱动的文化是其后来居上的关键。
按公众号阅读文章与观点
Founder Park 转载「海外独角兽」的文章,从战略和组织两个角度拆解 Anthropic,认为聚焦 coding、坚持 scaling laws 与使命驱动的文化是其后来居上的关键。
Serval 以 AI-native ITSM 切入,用 Builder Agent 生成 TypeScript workflow、Help Desk Agent 调用已发布流程执行,把 AI 放在流程创建与请求处理两端,中间以可审计代码承接执行。
OpenAI 上线了图片验证页面,作者实测把图片发到微信重新保存、局部截图改格式后仍能被识别为 AI 生成。文章科普了两种溯源技术,C2PA 元数据是在图片文件里嵌入带签名的来源清单,Google SynthID 则是把不可见水印弥散到整张图的频率分量和颜色通道中。
墨水屏硬件被找到最适合的用法:开机时由 AI 推送 To-do、日历等基础备忘信息,用磁吸挂在屏幕边上;关机后利用墨水屏特性显示名片,方便他人直接查看加好友。该方案已打包成 Skills,供有类似硬件的用户尝试。
作者按照 Karpathy 提出的 llm.wiki 思路,用 raw 放原始材料、wiki 放 AI 维护的知识中间层、AGENTS.md 规定组织方式的三层结构,让 Agent 自动构建知识库。
Nous Research 的开源智能体项目 Hermes Agent 近期在国内走红,自 2 月开源以来已获得超 5.2 万 stars,并在社区引发从 OpenClaw 迁移的讨论。
Anthropic 发布 Claude Managed Agents,一套用于构建和部署云托管 AI Agent 的可组合 API,核心是经调优的 Harness 编排引擎。架构上将 Session、Harness、Sandbox 三层解耦,凭证不进入沙箱,官方称 p50 TTFT 下降约 60%。定价为标准 token 费率加每 Session 活跃运行时间 $0.08/小时,空闲时间不计费。
推荐理由:文章拆解了 Managed Agents 的 Harness 解耦架构与计费方式,可据此理解 Anthropic 转向 Agent 基础设施的路径。
维塔流动完成数千万元人民币 Pre-Seed 轮融资,由锦秋基金领投、百度风投跟投,资金用于产品研发与市场推广。该公司由前字节跳动产品高管、前阶跃星辰 C 端产品合伙人张心皓创立,旗下产品 Jovida 定位面向 C 端用户的主动式 Life Agent,覆盖健康管理、自律习惯、学习成长等生活场景,强调主动提醒与 context 感知能力。
原文内容为微信公众号页面提示信息,未包含可提取的科技新闻事实,无法生成有效摘要。
OpenClaw 发布 2026.3.22-beta.1 预览版,彻底重构插件系统并上线新的公开插件 SDK,旧 extension-api 被移除,ClawHub 成为插件分发首选来源。
OpenAI 前 CTO Mira 的 Thinking Machines 发布研究预览版交互模型,模型名为 TML-Interaction-Small,为 276B MoE、每次激活 12B 参数。
Monad 首席 AI 工程师 Jarrod Watts 拆解了 Codex 的 /goal 长运行 agent 机制,发现其本质是重复提示的 Ralph loop 加 SQLite 跟踪,认为任务模糊性会随迭代复利增长。
海外独角兽发文拆解 Anthropic,认为其聚焦 coding 的战略和使命驱动的组织文化是它区别于 OpenAI 的关键。文章提到,Anthropic 在 2021 年已有一份联创内部文件提出聚焦 coding,但先做了通用模型底座,ChatGPT 爆火后转向 toB 并强化 coding;2021 至 2023 年其人才留存率为 80%,OpenAI 为 67%。
AGI Playground 2026 定于 8 月 3 日至 4 日在新加坡滨海湾花园举办,主题聚焦 AI Agent 与 AI 硬件,分别对应 "Go Action" 和 "Go Physical" 两个方向。
DESIGNMD.sh 是一个提供 DESIGN.md 设计说明文件的 Registry site,这些文件供 Agent 读取,用来指导生成一致的 HTML/CSS/UI。它收录了二十多种知名品牌的设计和配色风格且仍在增长,用 npx designmd.sh add <owner/repo> 可把文件拉取到项目里,作者还把其中 21 种风格做了可视化。
腾讯 ima 知识库上线了 Agent(copilot),默认使用 GLM-5.1,官方提供 3 种大模型,并支持添加 DeepSeek、Kimi、智谱、MiniMax、混元、千问等自定义模型(需各家 API KEY)。
美图领投视觉 AI 创业公司 Chance AI 数百万美元天使轮融资,NYX Ventures、阿里系投资机构等跟投。Chance AI 成立于 2025 年 8 月,主打以「意义推理」为核心的 Visual Agent,累计用户约 20 万,其中约 40% 来自北美,其 Visual Agent 在 MMMU-Pro 上以 86.07% 位居世界第一。
Google 在 I/O 2026 开发者大会上集中发布了 Gemini 3.5 Flash、Gemini Omni Flash、Antigravity 2.0、Gemini Spark 等模型与产品更新。
推荐理由:逐项梳理 Google I/O 2026 的模型与 Agent 更新,读者可据此了解 Google 这半年的产品布局。
藏师傅的 PPT Skills 即将突破 10,000 Star,仅差 20 个,作者称这是其 vibe coding 以来首个破万 Star 的项目。该项目在市面上已有众多 PPT 生成 Skills 的竞争下,仅用 25 天完成这一突破,速度超过不少大厂知名项目。
ClackyAI 创始人李亚飞复盘开源 Agent 项目 OpenClacky 的 Harness 工程实践,总结出影响成本和效果的 7 个关键决策,第三代用 Ruby 从零重写。
Nexu 团队开源了项目 HTML-Anything,宣称要将一切 HTML 化,目前仓库已集成 75 套 HTML 模板及对应 skill(https://github.com/nexu-io/html-anything)。
豆包上线博物馆讲解功能,已与国内 20 多家博物馆官方深度定制合作,作者在首都博物馆“玛雅与安第斯文明特展”现场体验。打开语音和摄像头即可对准展品获得即时讲解,支持轻声交流,并可按听众身份(孩子或专业人士)定制讲解内容、匹配语速和难度。操作上在豆包 App 对话框底部功能栏点击“博物馆讲解”即可启动,相比传统固定讲解器不依赖固定路线。
BosonAI(李沐的创业公司)发布面向语音智能体的实时数字人模型 Higgs Avatar v1,只需一张静态照片即可生成会说话、倾听和回应的动态面孔,声音、口型、头部动作和表情均为逐帧实时渲染。官方称生成一帧仅需 16 毫秒,单张 H100 可支持 8 路实时对话并发。模型已进入内测阶段,将搭载于即将推出的语音聊天产品 Boson Presence,官网已开放 Waitlist。
火山引擎推出 Agent Plan,在 Coding Plan 的 coding token 之外,还打包了 Seedream5.0 绘图、Seedance2.0 视频生成、联网搜索、embedding 等 Harness 工具,无需为每个 AIGC 服务单独接 API。
藏师傅的 PPT Skill 搭配 Codex 与 HeyGen HyperFrames,可直接基于提问生成带动效的解释视频。Codex 还能在聊天中直接预览视频。
微信读书官方释出skill,支持搜书、看书架、阅读统计、导出划线笔记、书评推荐等能力,作者给出配置步骤。作者将全部划线笔记按每本书一个文档导入飞书,配置公网域名实现deeplink跳回App,并设置每天8点的cron job做增量同步,当日扫描116本书、新增5条划线,另用多维表格建阅读看板并让Agent对300多条划线做复盘总结。
Codex 官宣支持移动端,用户可在手机上通过 ChatGPT App 扫码授权,查看已在执行的任务。配置流程是升级到最新版桌面端 Codex,在设置中开启 Codex 移动版、手机扫码授权,再回到电脑端打开三个开关完成设置。作者建议配一台 24 小时开机的 MacMini,唯一依赖是家里不断电。
海外独角兽发布拾象 AGI 投资洞察,判断 Coding Agent 已成为头部 AI Labs 的最强共识,也是实现 AGI 的最好环境,而 Anthropic 发布 Opus 4.5 是让大众从 chat 转向 agent 模式的关键拐点。
KIMI 发布 WebBridge,这是一个 Chrome 插件,可让 KIMI 以及其他 Agent 控制浏览器的各类操作。作者用挂载 KIMI K2.6 的 Hermes Agent 实测,在即梦的指令框中粘贴 prompt 并提交生成图片,但返回的是 480x480 版本而非 2K 高清版,需要更明确地告知 Hermes 打开图片详情页才能获取高清版。
深度机智成立一周年累计完成多轮融资、总额数亿元,投资方包括中关村资本、普华资本、东方富海、蓝湖资本等。其PhysBrain 1.0仅用3000小时开源人类数据,在SimplerEnv WidowX Robot测试中取得80.2%平均成功率,超过π0.5 23.1个百分点。公司同时推出全尺寸拟人体机器人Prime及教育版Prime Lite,主攻“人类学习”路线的具身AGI。
在红衫 AI Ascent 2026 的两场演讲中,Claude Code 之父 Boris Cherny 称今年没写过一行代码,日常在手机 Claude App 里同时跑 5 到 10 个会话,并用自创的 Sloop 让 Claude 用 Cron 预约循环任务。
恒星AI推出全球首个影视级AI Agent「Starfilm」,将剧本、数字人、分镜、音乐、资产库五大能力耦合于一个平台,用户可在不到1小时内生成带配乐的完整AI漫剧单集。该平台同步启动「星光计划」,面向全球招募OPC超级个体,作品可直通红果、快手、TikTok、ReelShort等短剧平台分发。
一位开发者开源了一款轻量工具,支持 Claude Code 和 Codex 状态栏常驻,实时展示项目名、5 天和一周用量、上下文大小及百分比、输入/输出 token 消耗、缓存命中量和模型名。工具还提供最近 5 小时 dashboard、最近 20 个会话数据,以及按天/周/月输出报表,数据纯本地不上传。
作者介绍开源项目 Open-Slide,把它的仓库地址交给 Claude Code、Codex 等 Agent 安装并启动后,就能生成 Web 版演示,并可导出为 PDF 或纯 HTML。
Warp 已在 GitHub 正式开源(采用 AGPL 许可证),OpenAI 成为其新代码库的创始赞助商,并同步推出由云代理平台 Oz 管理的 Agent-first 协作流。
GPT-image-2 上线后,AI 生成的假图和聊天记录在社群、社媒刷屏,相关梗图一度冲上微博热搜第一。作者认为此前互联网默认截图和照片为真的底层假设正在瓦解,辨别的成本远高于内容本身的价值,因此唯一策略是关注信息源头而非信息本身。他提到 C2PA、Google SynthID 等水印方案都无法可靠检测一张图片是否由 AI 生成,建议把截图不等于证据刻进脑子,传播图片前多停三秒。
OpenAI 发布技术博客,详细介绍了 Realtime API 实时语音的低延迟架构。该架构采用 relay 加 transceiver 两层设计,relay 只做无状态 UDP 转发、不解密也不参与协议协商,transceiver 持有 ICE、DTLS、SRTP 等全部会话状态,系统可在 0.3 秒内完成首响应。
ChatGPT Plus 或 Pro 订阅用户可通过 Hermes 的 `hermes tools` 命令,为 Hermes 接入 GPT-Image-2 生图能力,选择 OpenAI (Codex auth) 免 API key 的 gpt-image-2-medium 后重启 gateway 即可使用。
一场两小时的央媒内部分享围绕"上下文"展开:大模型生成本质是给定上下文不断预测下一个 token,ChatBot 与 Agent 的区别在于谁来构建上下文,Agent 会自己搜网页、读文档、调工具。分享指出上下文越好幻觉越少但不会为零,并给出跟踪 AI 进展、自己上手、恪守红线三条落地建议。
作者在 MacBook Pro 上实测 MLX 与明略科技新开源的 Cider、Mano-P,认为端侧跑大模型已接近可用。Cider 是首个在 Apple GPU 上实现硬件加速 INT8 TensorOps 的开源框架,提供 W8A8 和 W4A8 模式,算子速度比原生 MLX 提升 1.4 到 1.9 倍,跑 Qwen3-VL-2B 的端到端预填充加速 57% 到 61%。