拆解 Claude 5.1:Fable 5.1 与 Mythos 5.1 如何拆分能力与权限
Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,两者底层使用同一套模型,区别在于能力开放范围被单独拆出。Fable 负责通用编码、知识工作和 Agent 任务,Mythos 面向经过验证的网络安全和生命科学研究场景,可进入更深的工具调用和专业任务。
按公众号阅读文章与观点
Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,两者底层使用同一套模型,区别在于能力开放范围被单独拆出。Fable 负责通用编码、知识工作和 Agent 任务,Mythos 面向经过验证的网络安全和生命科学研究场景,可进入更深的工具调用和专业任务。
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1 两款底层架构相同、安全防护等级不同的模型,Fable 5.1 面向大众开放,Mythos 5.1 仅通过可信访问计划向特定机构开放。
推荐理由:缓存读取价格下调75%并给出分子设计与金星地形重建案例,便于对比新旗舰的能力与成本结构。
神秘具身团队放出代号 MVP(Make Veritable People)的自进化模型 Demo,展示机器人在木棍推搡下端水不洒、同时扶住易拉罐,并 zero-shot 完成客厅收纳,团队称 zero-shot 成功率已达 80%。该模型主打对物理规律与人类行为逻辑的统一理解,支持一脑多形跨本体协作,两台不同型号机器人仅用人类视频训练即可组队抖床单。团队表示即将让机器人在开放环境上街演示。
OpenAI公开下一代模型Astra的网络安全能力:在公开漏洞利用基准ExploitBench上拿到100%成功率,在内部新题中显著领先GPT-5.6 Sol,还自主发现并利用两个零日漏洞串成完整攻击链。
深圳团队 EvoMap 推出 EvoX,用无中心调度的蜂群模式组织 AI Agent 协作,同一 Claude Haiku 4.5 模型在 563 道逻辑、数学和物理题上正确率从单 Agent 的 26% 提升到 70% 以上。
Ropedia 联合创始人兼首席科学家刘子纬在 AGI Playground 2026 提出,物理 AI 下一阶段要 Scaling 的不只是参数和算力,还有人类关于物理世界的经验。
Calendly 工程团队把规划、实现、QA 和问题调查等 Agent 接入 Jira、GitHub、CI 等原有系统,形成带人工检查点的工程闭环,人类仍在最终 Review、Approve 和 Merge 环节负责。
据《The Information》援引知情人士消息,OpenAI 即将推出的旗舰模型 Astra 采用了名为循环深度(recurrent depth)的技术,让文本在输出下一个词前于同一网络层中反复处理,用计算深度换取参数规模,显著降低内存和带宽成本。
李飞飞创业公司 World Labs 发布新一代世界模型 Atlas,从零开始预训练,原生处理文本、图像、视频和 3D 四种数据,支持以像素级相机控制生成最高 1440p、最长 1 分钟的视频,并能重建点云与 3D 高斯泼溅。
VAST 发布 3D 生成模型 Tripo P2.0,在扩散模型生成过程中直接产出原生四边面拓扑,三角面最高支持 50000 面、四边面最高支持 25000 面。官方称正式版将加入局部重新生成功能,用户可只修改选中区域,其余部分保持不变。VAST 同期宣布完成 B 轮和 B+ 轮融资,合计约 30 亿人民币,不到半年累计融资约 50 亿元。
Anthropic 发布 Fable 5.1,输入输出价格维持每百万 token 10 美元和 50 美元,缓存价格下降 75% 至每百万 token 0.25 美元,典型工作负载总成本比 Fable 5 低约 25%。
UU远程上线新版本,重点补齐终端功能,加入完整的 TUI 交互渲染与终端会话管理能力。新版本支持同时创建、连接和管理多个终端会话,会话可在手机与电脑之间同步,并可用 uuyc-cli lterm attach 等命令跨端接管,同账号控制本设备后进入系统也无需再输 Mac 解锁密码。
World Labs 发布新一代多模态世界模型 Atlas,团队从零开始预训练,使其原生处理文本、图像、视频和 3D 数据。Atlas 支持像素级相机控制,可从一张或多张图像生成最长 1 分钟的 1440p 视频,也能重建真实世界场景,官方称其性能优于目前最先进的 3D 重建专用模型。该模型目前面向部分合作伙伴开放早期访问,将用于 Marble 及其他产品。
Anthropic 在 Fable 5.1 发布同日推出官方提示词指南,逐条列出该模型与 Fable 5 的 15 处行为差异,并为每条附上可直接复制的修正提示词。
推荐理由:指南逐条解释新旧模型的行为差异并附可直接复制的修正提示词,便于对照清理旧 prompt 中的过时补丁。
鼎犀智创(Rhinovate™)近日完成数亿元 Pre-A 轮融资,由鼎晖百孚领投,资金用于 RhinoMat 材料科学基础大模型、多场景可编排 AI 智能体与自主进化实验室体系建设。
微软亚洲研究院、悉尼科技大学与清华大学提出 UniSteer,通过动作到噪声的近似反演将人类纠正转为噪声监督,让监督学习与强化学习共同更新同一个轻量 noise actor,预训练 VLA 动作解码器保持冻结。
前字节跳动Seed团队强化学习专家、腾讯Robotics X智能体中心前负责人孙鹏博士正式加入星尘智能,将重点负责机器人强化学习方向的技术研发与应用探索。星尘智能采用“AI模型+具身OS+绳驱本体”全栈架构,已推出Lumo-1、Lumo-2具身模型及Agent Philia,其T1机器人起售价8.99万元,产能已达万台级。
Violoop 完成亿元级天使轮及 Pre-A 轮融资,投资方包括联想创投、中金保时捷、蓝驰创投、元生资本等,并与联想签署战略合作协议。其手掌大小的 Agent 硬件通过数据线连接电脑,读取屏幕内容并在用户授权后操作软件,创始人何佳霖称目标是让 AI 自己获得上下文、用户只保留选择和确认,测试已覆盖全球 200 多名内测用户。
Hugging Face 联合旗下机器人团队 Pollen Robotics 于 8 月 27 日发布开源机器人 Microduck,售价 399 美元,五天预购超一万只,平均每四秒售出一台。
面对AI社交监管收紧,作者判断AI不会颠覆社交,因为社交的核心需求是"被另一个真人看见"。OpenAI与MIT研究显示,ChatGPT用得越久孤独感越强;Character.AI月活约2000万、付费转化率仅1%出头,估值从25亿美元回落。同期全球社交媒体用户达56.6亿、一年净增2.59亿,微信月活14.39亿、Meta全家族日活36亿,AI反而放大了广告与增值付费的变现效率。
百融智能2026年上半年AICC业务收入1.66亿元,同比增长52%,其中新场景收入增长195%,公司采用RaaS按成功有效通话或工单收费,物流场景单次处理成本比传统人工降低50%以上。
李飞飞团队 World Labs 发布多模态世界模型 Atlas,官方称其为全球首个,最高可输出 1 分钟、1440p 的视频并支持像素级相机控制。Atlas 基于多模态自回归扩散 Transformer 架构,能完成 3D 重建与时空模拟,在相机控制生成和 3D 重建任务上超过 SOTA。
强化学习专家孙鹏正式加入星尘智能,负责机器人强化学习后训练。孙鹏博士毕业于清华自动化系,曾任腾讯 AI Lab 高级研究员、字节跳动游戏 AI 部门多智能体与大规模强化学习负责人,主导开发强化学习基础设施 ByteRL,并参与 ReFT、DeltaProver 等项目。星尘智能八月刚发布隐式世界动作模型 Lumo-2,其加入将加强公司在机器人强化学习及后训练方面的研发能力。
8 月 31 日,面向物理世界的自进化基础设施 PhyAgentOS v1.0.0 正式发布,由 X-Era Lab(拓元智慧)、中山大学 HCP 实验室与鹏城国家实验室具身智能研究所联合研发,以 MIT 协议开源,GitHub Star 数接近 2000。
字节 8 月 25 日把豆包工作作为独立产品上线,与飞书生态深度打通。作者用一周实测走通从飞书多维表格读取 10 个产品灵感、安装 GitHub 喜茶风 Skill、批量生图、写 PRD 到原型建站的链路;另一次任务在半小时内经 3 轮 GitHub 检索、去重 966 个以上候选仓库,交付 DOC、Excel、PPT 三份文件。
Anthropic 推出编程与知识工作模型 Fable 5.1,并面向 Mythos 权限用户发布 Mythos 5.1,典型工作负载按 Token 计费成本比 Fable 5 低 25%,高度智能体化任务最高省约 45%。OpenAI 称即将推出的 Astra 是首个超越其网络安全能力阈值的产品,将限制相关能力访问。苹果新任 CEO 特努斯首次向全员发表讲话,预告下周 iPhone 发布会。
吴恩达在与 Silicon Valley Girl 主持人 Marina Mogilko 的长谈中表示,AI 也许能完成一份工作中 30% 到 40% 的任务,剩下由人完成的 60% 反而更有价值,他建议把 AI 能做的那部分交出去,人转向 AI 暂时做不到的部分。
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,两者使用相同底层模型,区别在安全保护级别,Mythos 5.1 仅通过受信任访问计划提供给部分网络安全和生命科学机构。
ClawBench 让 AI agent 在 144 个真实生产网站执行 153 个日常写操作任务,最强 Claude Sonnet 4.6 完成率约 33%,GPT-5.4 仅 6.5%。153 个任务中有 68 个(44.4%)没有任何模型能完成,失败集中在反爬验证、登录卡关和已到确认页却未提交。Qwen 3.5 以 26.1% 排名第二,GLM-5 为 24.2%。
Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1,两者使用同一个底层模型,区别在于安全限制,Fable 5.1 面向普通用户、开发者和企业开放,Mythos 5.1 只提供给经过审核的高风险领域合作伙伴。
推荐理由:新模型在科学研究型 Agent 基准上提升明显,缓存读取价格下调 75%,可据此判断 Agent 任务的成本变化。
IEEE 指出,铒和钇两种小金属分别用在 AI 数据中心的长距离光通信和燃气轮机供电环节,中国占两者几乎 100% 的产量。铒以掺铒光纤放大器(EDFA)放大 1550 纳米波段的光信号,钇则以氧化钇稳定氧化锆(YSZ)作为燃气轮机涡轮叶片的热障涂层。
Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1,在 8 项公开基准测试中全部第一,价格最高下降 45%。
推荐理由:缓存读取价格降至每百万 token 0.25 美元,加上思维链签名校验,读者能看到定价与上下文管理的具体改动。
Anthropic 发布 Fable 5.1 与 Mythos 5.1,官方数据显示其在 Terminal-Bench-Science 0.1、Terminal-Bench 4.0、CursorBench 3.2.0 等基准上位列第一。
前 Linear 产品负责人 Nan Yu 宣布加入 OpenAI,负责 Codex 和 ChatGPT 相关工作。同一天前后,OpenAI 还引入 Kairos Computer 两位联合创始人,三人共同指向 Codex 与 ChatGPT 方向。结合 ChatGPT 与 Codex 团队此前的合并动作,这轮人才引进被视为 OpenAI 强化产品体验与 Agent 能力的重要一步。
Hugging Face 旗下 Pollen Robotics 推出双足机器人 Microduck,预售价 399 美元,开订 6 小时订单额突破 100 万美元,24 小时超过 260 万美元。
MiniMax 两个交易日累计涨超20%,起因是 fal 基于开源 H3 优化的 H3 Max 让 AI 视频生成快过播放,撑起 24 小时实时直播。H3 Max 生成 5 秒 768p 视频不到 3 秒,吞吐量约为官方 H3 端点的 35 倍,768P 定价 0.58 元/秒。文章认为这更像短线催化,真实付费转化与实时视频的单位经济性尚未被验证。
Yukai Engineering 联合创始人兼 CEO 青木俊介在 AGI Playground 2026 上表示,其挂件机器人 mirumi 没有摄像头、屏幕,也未接入大模型,却在 Kickstarter 众筹超 7400 万日元并登上米兰时装周 GCDS 秀场。他提出「用枯萎的技术做水平思考」等四条设计原则,认为消费级机器人比拼的不是参数量与跑分,而是能否唤起人的情感。
Codex 新增 Ultra 模式,会尽可能调用 sub-agents 并行工作,比非 Ultra 模式更聪明也更快,但 token 消耗速度肉眼可见地变快。在 5xPro 订阅下,Ultra 模式恐怕只够 1-2 天全力燃烧,想撑满一周估计得用 20xPro;Ultra Fast 模式则更耗额度。
影眸Hyper3D正式发布世界生成模型WorldGen,上传一张场景图可在2到3分钟内生成可交互、可编辑的3D场景,每件资产独立生成并保留空间与物理关系。开启SimReady模式后,系统会为资产补充碰撞体,并估计质量、摩擦系数、恢复系数等仿真所需物理属性,生成资产可导入Blender、Unity、Unreal Engine等引擎二次创作。
Codex CLI 代码库中出现新的 _context 工具,可让 Agent 感知上下文剩余空间,并配合硬切窗口、工作注释和历史记录查询,替代反复压缩上下文的做法。有网友发现 GPT-5.6 数据经压缩后保真度较 GPT5.5 和 5.4 下降。截至发稿,OpenAI 官方文档仍将 compaction 列为长任务上下文管理机制,该功能或仍在准备或测试阶段。