万字长文:做了些爆款 Skills 以后,我对 Skills 的看法
歸藏基于自己做 PPT、社交媒体卡片、Logo Generator 等 Skill 的经验,阐述了对 Agent Skill 的看法,认为 Skill 是把专家经验、工作流、品味和工具调用封装成可分发、可复用、可迭代的 Agent 能力单元。
按公众号阅读文章与观点
歸藏基于自己做 PPT、社交媒体卡片、Logo Generator 等 Skill 的经验,阐述了对 Agent Skill 的看法,认为 Skill 是把专家经验、工作流、品味和工具调用封装成可分发、可复用、可迭代的 Agent 能力单元。
千问在 app 内上线名为「美加墨」的足球预测 AI 助手,包含「比赛日历」和「预测投票」两大板块,用户可参与比分预测赢积分。该助手从比赛定性、核心论据、进球剧本、场外因素四方面给出预测理由,并推演了梅西与C罗本届世界杯能否相遇。用户总积分每达一定额度,千问将为乡村及基础薄弱地区学校捐建或修整足球场,目标至少50所。
在 MiMo Code 中,非登录状态默认即为 MiMo Auto 模式提供的 MiMo-V2.5 限免版本,可直接使用。该 TUI 支持鼠标点击,通过 Tab 切换模式,但每次点击 Tab 后需用鼠标点回聊天框,否则会失焦;官方文档见 https://mimo.xiaomi.com/zh/mimocode/start。作者测试后认为简单任务问题不大,复杂任务与 Codex 相比仍有差距。
中国大模型公司正陷入只拼模型能力的认知陷阱,而真正能支撑万亿美元市值公司的赛道只有编程和办公两个。Anthropic活跃用户仅为OpenAI的七分之一,却拿下全球LLM市场31.4%的收入份额,Claude Code的ARR从2025年12月到2026年2月翻了一倍多。中国拥有超700万软件开发者,谁先做出中国版的Claude Code,谁就拿到这个市场最厚的利润。
我国首部儿童手表安全强制性国家标准《儿童手表安全技术要求》已发布,将于2027年1月1日起全面实施,首次在国家级层面对内容安全、防沉迷、个人信息保护、付费管控划定底线。2025年中国儿童智能手表出货量达1791万台,在义务教育阶段学生中渗透率已超10%,行业长期存在沉迷游戏、诱导消费、信息泄露等问题。标准推动下,儿童手表或将回归以定位、通话、健康监测为核心的"守护"本质。
2026年6月,OpenAI与Anthropic相继提交保密IPO文件,OpenAI此前已让600多名员工通过二级市场套现约66亿美元,AI财富正重塑旧金山。当地一居室租金中位数涨至4000美元,SoMa一年涨36%,同时一批懂AI、GPU和长寿主义的年轻女性向技术新贵提供3000至6000美元一小时的高端陪伴服务。
GPT-Image-2 的"美女怼脸自拍"Prompt 模板公开,设定为 9:16 比例、iPhone 16 Pro 前置摄像头人像模式,镜头为 extreme facial close-up shot,俯仰角度在平视、轻微仰视、轻微俯视、头顶俯视中随机。
美图影像研究院联合北京交通大学提出基于扩散模型的图像属性操纵框架 All-in-One Slider,已被 CVPR 2026 接收。该框架用轻量级属性稀疏自编码器将文本嵌入空间分解为稀疏语义属性方向,训练一次即可作为通用滑块,对年龄、表情、妆容、发型等属性做连续细粒度控制,并支持多属性组合与未见属性的零样本泛化。
在 GAIR Live 圆桌上,MemLens 主导作者任玺谕与丘脑智能 CEO 张源讨论多模态长程记忆为何落地难,认为瓶颈主要在证据写入时的有损压缩和跨模态检索,而非模型推理层。
Anthropic 推出 Claude Fable 5 和 Claude Mythos 5,其中 Fable 5 面向公众开放,Mythos 5 仅提供给少数网络安全防御机构、关键基础设施方和生物医学研究者。
华为面向大模型推理和训推一体场景推出的昇腾950PR,被视为国产算力从"单点替代"走向"系统竞争"的拐点。文章认为其投资逻辑要看四本账:性能账、产能账、系统账和商业账,机会不在芯片本身,而在制造、先进封装、PCB与材料、高速互联、液冷供电及软件生态等产业链瓶颈环节。
6月11日阿里宣布钉钉管理层调整,陈航卸任CEO,由1992年出生的技术极客陈宇森接棒。文章复盘陈航自2025年3月31日回归、共执掌钉钉437天的历程,其间推出AI钉钉1.0、钉钉ONE和全球首个企业级AI原生工作平台悟空,ONE的DAU曾达300万后留存下滑并被拆分。6月4日和8日的两篇长文曝光钉钉内部管理问题,阿里合伙人委员会随后罕见公开批评其管理方式。
硅谷投资人 Sarah Guo 撰文《The Untrainable》,反驳今年流行于投资圈的 AI 绝望论,即除了 Anthropic 和 Nvidia 什么都不值得投。
DeepSeek 正在招募「Agent Harness 研究员」,全职和实习生(开发/研究岗)都要,工作地点在北京,也可 base 杭州但需先在北京入职一段时间。该职位在大模型行业应为首次对外招聘,方向涵盖上下文管理、长期记忆、Subagent 与 Multi-Agent、自进化 Agent,并要求熟悉 LLM API、KV Cache、Agent Loop、Tool Use、MCP 等机制。
Anthropic 在 6 月 10 日发布 Claude Fable 5 与 Claude Mythos 5,Fable 5 被处理到可面向普通用户开放,官方称其在几乎所有基准上达到 SOTA。
推荐理由:文章用第三方榜单与真实重构、迁移案例,说明 Fable 5 更适合长程工程任务而非日常写代码。
Ramp 发布 AI Index 显示,AI 采用程度前 1% 的美国公司每位员工每月在 AI 工具和算力上支出达 7500 美元,与中位数公司的差距高达 680 倍。报告还指出 Anthropic 已覆盖 41% 的美国付费 AI 企业用户,DeepSeek 在 2026 年 6 月趋势厂商榜中位居第一。尽管 token 单价大幅下降,企业 AI 总账单仍上涨约 320%。
Anthropic 为 Claude Code 推出动态工作流(Dynamic Workflows),目前处于研究预览阶段,可动态生成协调脚本,将复杂任务分解为子任务、并行执行并在给出最终答案前验证结果。
陶哲轩主导的 First Proof 项目公布第二批评测结果,10 道前沿研究级数学新题中有 7 道获得达到学术发表标准的 AI 解答,其中 Problem 5 随机偏微分方程题 AI 用与人类完全不同的方法推出更强结论。
开发者发现把 Claude Fable 5 的努力程度调到最低 low 档后,token 消耗更少,且在 SWE-bench Pro 上拿到 75.0 分,仍高于 Opus 4.8 开到 xhigh 档的 68.6。
GPT-Image-2 世界杯组队海报提示词模板公开,只需替换 {动漫} 名称即可生成 11 人足球队海报。模板要求 9:16 比例、半写实日漫加 BlueLock 体育竞技风格,顶部需为 2026 世界杯决赛阶段国家名,并强调同一人物不得重复出现。
Founder Park 启动 2026 中国 AGI 创新影响力机构 TOP 30(MVP 30)调研征集,面向以中国企业为主的 AI 初创公司与上市公司产品,覆盖基础设施层、模型层、应用层。申报截止 7 月 3 日,评审 7 月 24 日终止,结果将于 8 月 3 日至 4 日在 AGI Playground 2026 大会现场及线上公众号公布。
Loop 是让 AI 持续迭代直到目标达成的递归结构,由自动调度、工作树隔离、Skill、连接器与子 Agent 五个模块加一个记忆机制组成,Claude Code 和 Codex 都已具备。
OpenAI 公布 Codex 编码智能体在 Windows 上的沙盒架构细节,因现有 Windows 隔离机制无法满足自主编码智能体需求,其自研了自定义方案。
快手资深服务端架构师郭勇良在 QCon 2026 北京站分享了主站 RCA Agent 的探索实践,目前整体准确率达到 80% 以上,但该数字包含大量告警噪声,推理层面的准确率并没有这么高。
InfoQ 译介的文章介绍自适应 Hedged Request 机制,用 DDSketch 实时估计分位数并在请求变慢时发起对冲请求,5 万次请求的基准模拟中 p99 从 65 毫秒降至 17.3 毫秒,约降低 74%。
华为数据存储产品线副总裁吴俊杰在 InfoQ《C 位面对面》中提出,Agent 爆发正带来“Token 大爆炸”,OpenAI 最大 Token 用户月消耗量已从六年前约 10 万增至 2026 年的 10000 亿,每 Token 成本控制取决于数据基础设施。
微信开始内测语音输入法,作者称自己近两年的稿子几乎全靠口述完成,一篇 1500 字初稿说出来约十分钟、打字要一个多小时。锤子 2016 年 M1 发布会曾用讯飞输入法实时转写、2018 年 TNT 主打 Touch and Talk,如今配合大模型的语音输入可自动删语气词、理顺序并按文风改写,Big Bang、One Step、闪念胶囊也能在划词问 AI、Agent 跨应用、AI 助手中找到影子。
谷歌发布并开源扩散文本模型 DiffusionGemma,采用一次铺开256个token整块去噪的方式,在单块H100上跑出1000+ tokens/s,比同规格自回归模型快约4倍。
复旦与腾讯混元团队提出 Baton,一个基于显式语义蓝图引导的联合视频音频生成框架,先用可学习 MLLM 完成跨模态语义规划,再把 planned tokens 注入扩散模型指导生成。
Meshy 发布 3D 创作 AI Agent「Meshy 3D Agent」,称其为全球首个 3D 创作 AI Agent,可通过多轮对话完成从概念探索到模型导出的完整流程。
6 月 9 日,TRAE SOLO 正式升级为 TRAE Work,桌面端与网页端同步上线,品牌主张为“让 TRAE 为你工作”。升级后同一套 Agent 能力从 AI 编程外溢到更广泛的工作场景,实测可完成从想法到可交互原型、以及处理 100MB 级 CSV 数据并生成可交互网页报告等任务。
北京某大厂大模型App立项时曾考虑取名「千问」,最终被大老板否决,不久后阿里「通义千问」横空出世。某手机巨头跟进Claw项目因算力供给不足延期,以OpenClaw为代表的Agent框架算力需求是普通模型的十几倍。某初代国产大模型独角兽陷入内部混乱,核心联创离场,创始人深夜十点查岗质问团队为何不爱工作。
八点八数字旗下 AI 短剧协作平台 AniShort 完成近亿元融资,由北京泰中合领投,老股东全线加码,为 2026 年国内 AI 短剧工具类产品最大单笔融资。
6月10日,阿里千问发布高考志愿填报Agent,免费为全国考生提供志愿填报咨询,核心能力包括志愿日历、志愿报告和志愿问答。该Agent基于专门针对高考志愿填报打磨过的Qwen大模型,结合夸克8年高考服务数据与经验,知识库覆盖全国近3000所高校、2000多个专业。
GUI Agent 执行平台 Core-Mate 完成数千万元人民币融资,由敦鸿资产独家投资,资金将用于底层技术升级、移动端 UI 视觉感知迭代和用户拓展。团队核心成员来自字节跳动,创始人桑一凡曾任抖音、豆包产品经理,并将屏幕语义理解能力 OpenGUI 开源,同时研发 Action Recorder 支持用户录制专属流程。
AI产品榜(AICPB)第 36 期网站榜 2026 年 05 月榜显示,Claude 月访问 9.72 亿、环比 +15.67% 逼近 10 亿,DeepSeek 以 5.41 亿、+11.22% 突破 5 亿,为全球 TOP10 中仅有的两个两位数增长产品。
Akamai 亚太区云计算架构师总监李文涛称,一家亚太 AI 情感陪伴出海公司改用 Akamai 推理云、RTX PRO 6000 与 FP4 精度后,每百万 token 综合成本从近 4.5-5 美元降至 1.8 美元,AI 与 IT 开销砍掉约六成并转向盈利。
Cursor 发布《2026 年春季 Cursor 开发者习惯报告》,基于真实产品数据记录 AI 编程从单点提效走向系统自动化的变化。报告显示代码编写速度同比增长一倍、每次提交代码量同比增长约 2.5 倍,AI 生成代码被接受后 60 分钟仍留存的比例从约 76% 升至 81%。
这是一篇 WorkBuddy 的从 0 到 1 上手教程,作者用一个办公任务和一个网页开发任务串起安装、登录与核心功能。WorkBuddy 提供代码开发、日常办公、设计创意三种场景,工作模式分为 Ask、Plan、Craft,内置混元、DeepSeek、GLM、Kimi 等国产模型,还支持专家、技能市场、MCP 连接器和微信远程控制。
作者用 MemOS CLI 为 Hermes、OpenClaw、Codex、Cursor、Claude Code 接入同一套长期记忆,实现跨机器、跨 Agent 的备份、迁移与隔离。