LibTV Agent 上线:用视频解说 Skill 分清「柯基」与「吐司面包」
liblib 家的视频 Agent 产品 LibTV Agent 正式上线,可一次性跑完剧本、分镜、角色、配音、配乐、剪辑整条流程,直接交付可发布的成片。用户可把艺术风格、工作流写成 Markdown 文档作为 skill 传入复用,线上商店已有 200 多位创作者制作的 skill。官方同步启动 1000 万现金池的 skill 激励计划。
微信公众号
liblib 家的视频 Agent 产品 LibTV Agent 正式上线,可一次性跑完剧本、分镜、角色、配音、配乐、剪辑整条流程,直接交付可发布的成片。用户可把艺术风格、工作流写成 Markdown 文档作为 skill 传入复用,线上商店已有 200 多位创作者制作的 skill。官方同步启动 1000 万现金池的 skill 激励计划。
Codex 暂时取消 Plus、Business 和 Pro 套餐的 5 小时使用限制,并正上线一系列改动提升 GPT-5.6 Sol 的使用效率,让完成同样任务消耗更少额度。公告称 Codex 与 ChatGPT Work 活跃用户数已突破 600 万,并将在未来一小时内完成一次使用额度重置。
Fable 5 的访问权限延期到 7 月 19 日,同时周限额提升 50%。原文未披露该产品的具体功能、所属公司或价格等更多细节。
OpenAI 官方 Prompting 指南(learn.chatgpt.com/docs/prompting)被译成中文,用目标、上下文、输出、边界四要素讲提示词写法,并给出 Codex 在代码探索、调试、测试、UI 原型和代码审查等场景的工作流与示例 prompt。
OpenAI 发布 GPT-5.6,包含 Sol、Terra、Luna 三款模型,并推出对标 Claude Work 的 ChatGPT Work。旗舰款 Sol 在 Agents' Last Exam 测试的 55 个行业长程工作流上得分 53.6,比 Claude Fable 5 高 13.1 分。
推荐理由:原文梳理了 GPT-5.6 三款模型的分档与命名规则,读者可以据此了解这次发布的产品结构与能力分层。
蚂蚁集团灵波团队(Robbyant)开源了面向机器人的视频生成模型 LingBot-Video,并放出技术报告。该模型 30B 总参数、3B 激活,采用 MoE 架构,可模拟流体、刚体、材质和镜头运动,训练数据包含超过 7 万小时具身数据。团队还用强化学习从感知、物理、执行三方面优化输出,称其在具身相关基准上超过 Cosmos 3 等五个开源模型。
蚂蚁灵波团队开源了 LingBot-Video,一个面向具身智能的视频生成模型,30B 总参数、3B 激活、MoE 架构。模型用互联网视频混合超过 7 万小时具身数据分五个阶段训练,在与 Cosmos 3、Wan 2.2、混元 1.5、LongCat-Video、LTX-2.3 五个开源模型的对比中,画质未全部领先,具身任务拿到第一。
OpenAI 发布新一代语音模型 GPT-Live,并从今天起成为 ChatGPT 的默认语音模式。它引入全双工,能一直输入、随时输出,并把聊天与干活解耦,遇到搜索、推理等任务时委托给 GPT-5.5 处理。
文章结合 Claude Code 文档解释了 Loop 的定义,即 Agent 重复执行工作循环直到满足停止条件。作者按 AI 承担多少工作把 Loop 分为回合式、把验收交给 SKILL.md、用 /goal 定义完成标准、以及定时任务 /loop 与 /schedule 四种模式,并给出选对模型、定清成功率与停止标准、把确定性工作写成脚本等六条省钱建议。
美国商务部已放行 GPT 5.6 全面发布,OpenAI 宣布 GPT-5.6 Sol 将与 Terra 和 Luna 一起于本周四公开推出。放行前 OpenAI 与政府官员进行了追加测试和多次会面,测试由商务部下属的 AI 标准与创新中心(CAISI)完成,OpenAI 的技术专家目前仍留在华盛顿。
Fable 使用期延长到 12 号。原文未披露 Fable 的具体功能、版本或所属公司信息。
腾讯混元 Hy3 正式版上线,微信小程序「成长计划」随之更新,开发者可领取 10 亿文本 Token 和 10 万张生图额度。按官方 API 价折算,10 万张图约值 20000 元,10 亿 Token 约值 1000~4000 元,此前领过 1 亿 Token 的报名开发者会自动补差值。
企业微信在微信公开课公布首批 AI 硬件,联合科大讯飞、得力、出门问问首发多款 AI 录音设备。其中得力录音卡官方称可连续录 45 个小时、待机最高两个月,录音内容接入企业微信「记录面聊」,靠声纹识别分辨每位发言的同事,并自动生成纪要与待办;新版「记录面聊」还与日程打通,开会时自动提醒录音。产品已正式开售,全平台搜「企业微信录音笔」即可找到。
AGI Bar 活动小程序正式上线,各类行业活动、场外投送、招聘和政策宣讲将通过该小程序同步。小程序支持一键报名、主办方自定义报名问题与 Markdown 导出,并将流水记账、发票合同、结案报告等流程 Agentic 化,所有记录可导出为 Markdown。该小程序开发历时 2 周、迭代 800+ 次,已通过 ICP 备案与信息审核。
Fable 5 回归,目前可在 Claude 中使用。Pro、Max、Team 和 Enterprise「高级版」每周使用量限额的 50% 可用于 Fable 5,7 月 7 日之后改为按使用积分(usage credits)计费,标准 Enterprise 席位没有免费额度、全部按积分计费。
推荐理由:原文列出 Fable 5 回归后的可用平台、额度规则与按量计费价格,可与 Opus 4.8 对比使用成本。
围绕 Codex 上手门槛高的问题,文章推荐了 B 站「Codex 跟练」系列视频,按【快速安装】【基础入门】【进阶技巧】【场景应用】四类梳理。PAPAYA 以校庆活动为案例贯通批量改表格、生成邀请函到自动发邮件;技术爬爬虾的教程覆盖安装、绘图、计划模式、云端运行、Skills、MCP 等全流程。
Anthropic 的 Fable 5 在出口管制解除后恢复全球访问,7 月 1 日恢复上线后,Pro、Max、Team 和高级版 Enterprise 每周使用限额的 50% 可用于 Fable 5,7 月 7 日后改为按 usage credits 计费,标准 Enterprise 席位没有免费额度。
推荐理由:文章结合官方公告梳理 Fable 5 解除出口管制的协议条件、越狱分级框架与计费变化,呈现前沿模型与监管协作的落地细节。
Anthropic 发布 Claude Sonnet 5,成为网页版默认模型,今天起全平台可用,Claude Code 和 API 中使用 claude-sonnet-5 这一名称。
赛博禅心发布了一篇 ChatGPT 广告投放指南,数据主要来自 Nexad 报告,梳理了广告位形态、出价与定向方式。ChatGPT 广告出现在回答下方并带 Sponsored 标签,出价分 CPM 和 CPC,定向用 context hints 描述适用对话而无关键词字段。
OpenAI 发布首颗自研 AI 芯片 Jalapeño,由 OpenAI 与 Broadcom 联合发布,专门用于大模型推理加速而非训练,并兼容所有 LLM。
推荐理由:芯片由 OpenAI 与 Broadcom 联合设计并给出 2026 年底部署时间和多代路线图,可用于观察自研算力的推进节奏。
AGI Bar 开放酒水品牌冠名,冠名后酒水价格从 39 元降到 8.9 元。上海店一款名为「稳稳接住」的酒已被面壁认领,即日起至下个月底更名为「面壁:稳稳接住」。更多酒水如「马上安排」「不兜圈子」「妥妥拿下」正在等待品牌认领。
赛博禅心介绍搭档 Jomy 提出的 SAG 方法,把多跳检索里的关系扩展交给 SQL JOIN,语义匹配和最终选择留给 embedding、rerank 和 LLM。
一篇解读文章梳理了 Claude Code 的 CLAUDE.md、Rules、Skills、Subagents、Hooks、Output Styles 等上下文注入方法及其适用场景。
智谱 GLM-5.2 发布后热度大涨,最新榜单显示它与 GPT-5.5、Gemini-3.1 同列前三,马斯克也回应了中国追赶 Fable 的时间。Hugging Face 表示为所有 GLM-5.2 模型的开销买单,但未提前通知智谱,智谱随后预告未来 5 小时免费。
Kimi Work(Beta 版)为 Kimi 电脑客户端带来目标模式和插件中心两项新功能,目标模式基于循环机制可连续工作 24 小时,适合目标清楚、路径不确定、需要多轮尝试且结果能验证的长任务;插件中心支持安装百度网盘、钉钉、飞书、WPS、Canva 可画、Notion、Cloudflare 等外部应用插件,通过斜杠调用。
文章披露了 DeepSeek 本轮融资的多个未公开情节,5月中旬公司组织了一场约四小时的投资人线上会议,梁文锋在会上反复强调只追求 AGI、克制与团队稳定性。本轮最初要求单笔额度不低于50亿、不能拆分份额,最终最小出资额下调至15亿,正式名单仅有10家机构参与,浅层穿透去重后约有近100家机构或个人。梁文锋对投资方最看重的仍是不要挖 DeepSeek 的人或撺掇他们出来创业。
GLM-5.2 已开源,采用 MIT 协议,744B MoE、40B 激活、1M 上下文,模型权重在 GitHub、Hugging Face 和 ModelScope 上线,API 同步开放且价格与 5.1 一致。
推荐理由:原文列出 GLM-5.2 的架构改动与多档基准对比,可用来判断开源模型在长程任务上的位置。
MiniMax 开源了 MiniMax M3 模型权重,并同步发布 MSA(MiniMax Sparse Attention)技术论文。M3 是 MiniMax 的原生多模态旗舰模型,总参数 428B,激活参数 23B,文中称其是第一个从 Step 0 开始做多模态混合训练的开源模型。
推荐理由:M3 从 Step 0 起做多模态混合训练并开源权重,同时公开 MSA 稀疏注意力论文,可了解其长上下文成本设计思路。
林亦团队用 GPT、Claude、Gemini、DeepSeek 裸猜 16 场欧冠,四个模型结果几乎一致,都只猜对 10 场,只会押强队赢。改用 4 万场比赛数据、每球员 45 项指标的精密 Agent 系统后,16 场仅猜对 7 场,反而不如掷硬币;而凭"足球直觉"拍脑袋的对照组"足球嘉豪"16 中 13。该作品参加了 B 站 AI 创造公开赛,冠军独享 100 万奖金。
智谱 GLM-5.2 今天全量开放,官方称其为智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,并能让 Agent 经历数千次工具调用而不崩。官方表示模型下周正式开源(MIT 协议)、API 下周上线,Coding Plan 全量用户今天即可切换。
美国政府援引国家安全权限向 Anthropic 发出出口管制指令,要求暂停任何外国人对 Fable 5 和 Mythos 5 的访问,无论其身处美国境内还是境外,Anthropic 因此对所有客户停用这两个模型。
推荐理由:原文收录了出口管制指令下 Anthropic 官方声明的逐段中英对照,可对比政府理由与企业回应的分歧。
一篇用修仙世界观类比当下 AI 生态的随笔:Token 是天地灵气,订阅制是内门月例(每月 20 美元、200 美元分档),API 用户是散修,数据中心是灵脉,英伟达是卖灵锄的,开源模型是城门口石碑上的功法。文中还把 Agent 比作傀儡、幻觉比作走火入魔、合成数据比作人造灵石、AGI 比作飞升,并调侃算力券、校招与蒸馏离职员工。
DeepSeek 正在招募「Agent Harness 研究员」,全职和实习生(开发/研究岗)都要,工作地点在北京,也可 base 杭州但需先在北京入职一段时间。该职位在大模型行业应为首次对外招聘,方向涵盖上下文管理、长期记忆、Subagent 与 Multi-Agent、自进化 Agent,并要求熟悉 LLM API、KV Cache、Agent Loop、Tool Use、MCP 等机制。
微信开始内测语音输入法,作者称自己近两年的稿子几乎全靠口述完成,一篇 1500 字初稿说出来约十分钟、打字要一个多小时。锤子 2016 年 M1 发布会曾用讯飞输入法实时转写、2018 年 TNT 主打 Touch and Talk,如今配合大模型的语音输入可自动删语气词、理顺序并按文风改写,Big Bang、One Step、闪念胶囊也能在划词问 AI、Agent 跨应用、AI 助手中找到影子。
Kimi 官宣公开预测世界杯全部 104 场比赛及夺冠队伍,并承诺本届世界杯每进一球向中国足球事业捐赠 10 亿 Token,用于支持基层项目、校园足球、青训教练和公益组织,预计覆盖超 1 万名足球从业者。其 205 页预测报告显示,西班牙和法国被视为最大夺冠热门,德国夺冠概率被市场低估,Kimi 测算为 11%、市场评估仅 7.4%。
Anthropic 发布 Claude Fable 5,它与只开放给政府和特定机构的 Mythos 5 是同一个模型,区别在于护栏。Fable 5 定价为 $10/百万 token 输入、$50/百万 token 输出,Pro、Max、Team 等用户可在 6 月 22 号前使用(消耗 Opus 两倍额度),之后需花 usage credits。
推荐理由:文章对比了 Fable 5 与 Mythos 5 的护栏差异,并给出作者实测中被退回 Opus 4.8 的体验。
瑞幸 CLI 上线并限量开放,Mac 可通过 curl -fsSL | bash 调用,Windows 可通过 irm | iex 调用。原文未披露具体功能范围与开放规模。
小米新模型实现 1000 tokens/s 的推理速度。原文未披露模型名称、参数规模及具体发布时间,仅称本周发布,另有内容正在筹备中。
Kimi 发布桌面端 Agent 产品 Kimi Work,定位面向知识工作者,支持最多 300 个 Agent 并行工作。核心能力包括 WebBridge 浏览器操控、同花顺/天眼查/iFind 等数据源接入、超长文本处理、PPT 生成和 Skill 系统,目前提供 Mac 版下载,Windows 版尚未上线。
扣子 3.0 上线,支持把本地或云端的 Claude Code 接入 Coze,用手机 App 远程操控电脑上的它干活。作者实测在手机上 @ 自己的 Agent,就让本机的 Claude Code 生成了一个可直接打开的单文件 HTML 网页,并称该方式相比魔改 Claude 网页版当中台更稳定,不受网络抖动和骚扰电话打断任务的影响。