X 上线 MCP,个人数据调用 0.01 美元/次并附配置步骤
X(Twitter)上线 MCP,作者实测配置后称针对个人信息的调用按 0.01 美元/次计费,1 美元可调用 1000 次,拉取最近三天书签花费 0.1 美元。配置需先在开发者后台创建 APP 并充值,记下弹窗给出的两个 ID,再让 Codex 或 Claude 协助写入 MCP 配置文件。首次启动需打开网页授权,详情见 docs.x.com/tools/mcp。
微信公众号
X(Twitter)上线 MCP,作者实测配置后称针对个人信息的调用按 0.01 美元/次计费,1 美元可调用 1000 次,拉取最近三天书签花费 0.1 美元。配置需先在开发者后台创建 APP 并充值,记下弹窗给出的两个 ID,再让 Codex 或 Claude 协助写入 MCP 配置文件。首次启动需打开网页授权,详情见 docs.x.com/tools/mcp。
Seed 2.1 Pro 正式发布,作者提前实测后认为它已能进入真实 Agent 工作流。测试通过豆包任务模式和火山引擎 API 进行,覆盖 PPT 与社交卡片 Skill,以及图片动效、WebGL 贝塞尔曲线、视差滚动网页三个编程任务。作者提到 Cloud Code 下视频输入更像是抽帧处理,API 已在火山引擎全量上线。
清华团队一念Unisonmind 线下演示了可本地运行的通用具身智能模型,无需遥控和预编程,能实时与环境交互,并适配人形机器人、四足机器狗及市售电动轮椅。演示中机器人准确数出随机拍球次数,还能相互沟通、自主完成去咖啡店点单取咖啡等任务。团队提出实现具身智能 AGI 的“3+1”个必要条件,包括一个脑子实现多模态流式理解与生成、端侧部署等。
GLM 5.2 正式开源,作者用两个复杂前端任务做了实测,称其在复杂动效和 WebGL 渲染场景下完成度不错。官方数据与多个第三方基准称其能力超过 Claude Opus 4.8,主要升级包括 100 万上下文、多思考等级和长程任务稳定性。
歸藏基于自己做 PPT、社交媒体卡片、Logo Generator 等 Skill 的经验,阐述了对 Agent Skill 的看法,认为 Skill 是把专家经验、工作流、品味和工具调用封装成可分发、可复用、可迭代的 Agent 能力单元。
MiMo 推出 MiMo V2.5 Pro UltraSpeed 超高速模型版本,每秒输出超过 1,000 Token,号称全球首个达到该速度的万亿(1T)参数模型。实测中峰值达 1426 Token/s,首次响应 0.83 秒,32 秒输出 25624 个 Token、约 1000 行代码;另一测试 TPS 为 1136 tokens/s。该版本面向对效率要求极高的 To B 客户。
作者预告将推出一个 Skill,用于解决 Live Photo 拼图、加排版文字以及把多个短视频拼成一个 Live Photo 的问题。目前制作这类内容较为复杂,且不少软件的相关功能需要收费。
歸藏发布了 iOS 阅读器即览,可在 iPhone 和 iPad 上打开 .md、.markdown、.html、.htm、.txt 以及网页打包的 .zip 文件,全部本地渲染,无需上传或注册账号。即览把动态脚本默认关闭,并支持目录跳转、夜间模式、桌面模式切换,此前已在 TestFlight 开放 8000 个名额。作者认为在 AI 工作流里 Markdown 更像数据层,HTML 更像展示层。
Kimi 电脑客户端新增本地通用 Agent 模式 Kimi Work,作者实测用其 Agent 集群解析金融数据,半小时产出一篇七八万字的研报,再基于研报并发生成几十页 PPT。
一个名为 guizang-social-card-skill 的 Skill 冲到 GitHub 本周新建项目 Star 排名第一。该 Skill 可方便地创建各种社交媒体的 3:4 卡片,并对图文混排做了深度适配。
Codex 发布一批体验更新,最受关注的是支持 Windows 的 Computer Use 以及通过移动端 ChatGPT 远程控制 Windows 上的 Codex,但 Windows 端在 Computer Use 运行期间用户无法同时操作,这点与 Mac 不同。
Cursor 发布一份开发者报告,显示头部用户与中位数在 AI 代码产出、token 消耗和 PR 合并量上的差距仍在扩大。报告指出 AI 写代码前的 input/output token ratio 大幅上升,缓存与上下文增量理解成为成本关键;手动 diff 验收减少,更多 AI 改动直接进入 commit,单个 PR 新增行数和 1000 行以上大 PR 占比都在上升。
动态工作流(Dynamic Workflows)发布,延续并发 Subagent 逻辑,启动的 Subagent 可能多达数百个,用于处理非常重、规模很大的任务。
歸藏开源了 guizang-social-card-skill,这是一个从 PPT Skill 中拆出、按 3:4 竖版图文卡片重新校准的 Skill,同时支持 21:9 和 1:1 公众号头图。
歸藏开源 AI Desk Card 项目,把一块磁吸 4.7 寸墨水屏接到 Claude Code 或 Codex,由 AI Agent 决定推什么内容、何时更换、息屏时显示什么。
Codex 昨晚发布更新,新增快捷截图添加上下文、/goal 目标模式、应用内浏览器高级注释和团队共享插件等功能。同时按住左右 Command 键即可截取鼠标所在窗口并自动填入输入框,截图还会把屏幕上未显示的文本一并加入上下文。
墨水屏硬件被找到最适合的用法:开机时由 AI 推送 To-do、日历等基础备忘信息,用磁吸挂在屏幕边上;关机后利用墨水屏特性显示名片,方便他人直接查看加好友。该方案已打包成 Skills,供有类似硬件的用户尝试。
藏师傅的 PPT Skills 即将突破 10,000 Star,仅差 20 个,作者称这是其 vibe coding 以来首个破万 Star 的项目。该项目在市面上已有众多 PPT 生成 Skills 的竞争下,仅用 25 天完成这一突破,速度超过不少大厂知名项目。
豆包上线博物馆讲解功能,已与国内 20 多家博物馆官方深度定制合作,作者在首都博物馆“玛雅与安第斯文明特展”现场体验。打开语音和摄像头即可对准展品获得即时讲解,支持轻声交流,并可按听众身份(孩子或专业人士)定制讲解内容、匹配语速和难度。操作上在豆包 App 对话框底部功能栏点击“博物馆讲解”即可启动,相比传统固定讲解器不依赖固定路线。
藏师傅的 PPT Skill 搭配 Codex 与 HeyGen HyperFrames,可直接基于提问生成带动效的解释视频。Codex 还能在聊天中直接预览视频。
WorkBuddy 新增 Agent 专家团功能,将功能互补的多个 Agent 打包,可一键调用并行完成复杂任务,团队内由主 Agent 负责调度与质量监控。实测中一个设计原型专家团以 Stripe 风格生成 SaaS 落地页,主 Agent 创建团队并分配角色、监控五个 Agent 进度,左侧可查看各角色输出并单独交互。
谷歌在安卓 I/O 大会上发布 Gemini Intelligence,将先在三星 Galaxy 和 Pixel 手机上推出,后续拓展到其他所有类型的安卓设备。
Claude Code 昨日更新 Agent 视图功能,可以在一个终端标签页里管理多个正在运行的 Agent,并标注每个 Agent 的状态,包括已完成、需要输入、正在进行。
歸藏开源并持续更新的 guizang-ppt-skill 迎来更新,新增瑞士国际主义风格、接入 GPT-Image 2.0 生成配图,以及小红书、公众号、视频号等多平台封面生成。该 Skill 在 GitHub 的 Star 已达 6000 多,新风格内置 22 个开箱即用的具名版式,流程延续先回答 6 个澄清问题、出大纲和主题节奏表后再写代码。
Claude Code 作者发文称其对外分享形式已全面转向 HTML,与 Obsidian 作者此前提出的 Markdown 是 AI 内容谢林点观点相互印证。两者共同勾勒出一套数据与表现分离的架构:事实性内容用 Markdown 作为底层 Memory 存储,HTML 接管表现层,实现高信息密度与可交互展示。该方案同时规避了 HTML 难以做版本控制、混杂样式会浪费 Token 的问题。
Codex 昨天更新内置 Chrome 浏览器插件,可直接控制你的浏览器执行任务。它能在后台跨浏览器页面并行工作,支持启动多个 SubAgent 同时操作多个网页,并且兼容所有基于 Chromium 的浏览器,作者用自己的 Dia 浏览器验证了这一点。用户在 Codex 插件库找到 Chrome 插件添加后,按引导打开浏览器插件页面安装即可使用,Mac 和 Windows 都支持。
Obsidian 作者认为 Markdown 已赢得 AI 时代文本格式之争,成为 AI 文件交互的事实基准,AI 时代的文本格式与内容展示基本被局限在 HTML 和 Markdown 两部分。
OpenAI 更新 GPT-5.5 Instant 模型并今天全量发布,ChatGPT 已将其设为默认模型,Codex 没有更新。该模型在法律、金融、医学等领域的幻觉率明显下降,图片理解和文档解析表现更好,回答更紧凑、废话变少,个性化能力提升。此外 GPT 引入记忆来源功能,可通过控件可视化查看 memory 来自哪里并直接编辑。
作者用一句话提示 Codex,在一个下午里做出类似《杀戮尖塔》的志怪 roguelike《夜巡录:荒庙篇》,含七个怪物、二十张左右卡牌和四条爆发链路,项目已开源并打包好 macOS 与 Windows 安装包(https://github.com/op7418/Night-Patrol/releases)。
Moxt 把 Word、PDF、Notion、Excel 等文件自动转成 md、csv、html 等 AI 原生格式,让 AI 在文件系统中导航,并把 Context 从一次性输入变成可累积的资产。
歸藏升级了自己的 PPT Skills,可在 Codex 中调用 GPT-Image-2 一键生成 PPT 配图。新增图片类型包括人文纪实风格配图、信息图与流程图、对比图、关系图,以及截图美化并调整到对应比例。同时优化了生成流程,改为先询问确认而不是直接生成 PPT,详情见 github.com/op7418/guizang-ppt-skill。
小米宣布 MiMo-V2.5 系列模型全部开源,采用 MIT 协议,允许自由商用、二次训练与微调,无需额外授权。
TRAE SOLO 与 Insta360 联名推出一款仅重 7.9 克的磁吸麦克风,搭配 TRAE SOLO 新上线的语音输入功能使用。该麦克风支持一键 AI 降噪、低延迟传输,TRAE SOLO 可智能转录并自动去除语气词、噪音和口语重复,还支持通过语音调用上下文、计划模式、Skills 等指令。即将上线的“实时语音交互”支持与 AI 直接语音对话。
DeepSeek V4 发布,包含 Flash 和 Pro 两个型号,支持 JSON 输出、工具调用、对话前缀续写和 FIM 补全。Flash 每百万输入/输出价格为 ¥0.2 和 ¥1,Pro 为 ¥1 和 ¥12,100 万上下文的输出价格翻倍,详情见 api-docs.deepseek.com/zh-cn/quick_start/pricing。
推荐理由:原文汇总了两个型号的功能支持与每百万输入输出价格,读者可据此对比选型和使用成本。
作者发现 Claude 桌面端可启用开发者模式接入三方模型,只需填写 API 地址和 Key,各种 Code plan 和三方 Claude API 均可使用。
Bloome 支持把本地 Agent 与线上 Agent 拉进同一个群,龙虾、Claude Code、CodeX 等可在群内协作,并自带云端 Agent 在电脑离线时处理轻量任务、开机后 @ 出本地 Agent 执行。添加本地 Agent 只需点右上角加号、选择“创建 Agent”并确认,还能用二维码把朋友的 Agent 拉进群,除自带免费 API 外也允许添加任意 API。