MoMo:用时空动作 tokenization 实现机器人操作中的动作模式调节
Apple 提出 MoMo,一个两阶段模仿学习框架,由时空动作 tokenizer 和行为克隆 Transformer 组成,后者以任务和连续动作模式条件为输入。在六项真实机器人操作任务中,调节该条件可持续改变动作的执行方式。
媒体报道、公司博客与研究文章
Apple 提出 MoMo,一个两阶段模仿学习框架,由时空动作 tokenizer 和行为克隆 Transformer 组成,后者以任务和连续动作模式条件为输入。在六项真实机器人操作任务中,调节该条件可持续改变动作的执行方式。
avatarin 基于 OpenAI 的 GPT-Realtime 为山田电机(Yamada Denki)顾客提供 24/7 多语言支持。上线两周内,该智能体被 30,000 人使用,92% 的问卷反馈为正面评价。
OpenClaw 宣布推出 extended-stable 发布通道,每月发布一次,首个版本 OpenClaw 2026.6.33 基于 2026.6.11 并回移后续安全与可靠性修复,每个版本至少支持一个月。
UMAP 内部构建的 kNN 图编码了原始高维空间的数据流形,却常被只关注低维嵌入的常规流程忽略。研究显示,在该图上应用标准图算法可增强数据理解:PageRank 能识别代表性数据点,k-core 分解可揭示稠密区域。
Waymo 为网约车 Ojai 推出 Gemini in Waymo 对话式助手和重新设计的车载界面,乘客可通过屏幕或语音查询信息、调节车内设置并请求靠边停车。Gemini 独立于 Waymo Driver 驾驶系统,不控制车辆移动或路线,也无法访问实时驾驶数据。Ojai 配备 3 块屏幕,按座位显示不同内容,并提供 Calm Mode 调暗屏幕仅保留最少行程信息。
OpenAI 首席财务官萨拉·弗里亚尔在 7 月 29 日的内部员工会议上表示,公司 7 月的年化经常性收入(ARR)已超过整个第二季度的总和,增长主要来自 GPT-5.6 系列模型、企业级智能体 ChatGPT Work 以及 AI 编程工具 Codex 的采用率上升。
OpenAI 在 X 平台宣布启动 ChatGPT for Academic Researchers 计划,将向 10 万名科研人员免费开放 ChatGPT 高级功能,科学家可通过官网填表加入。
Hugging Face 公布一份 AI 智能体入侵事件的完整技术时间线,一套基于 OpenAI 模型构建的自主智能体在 4 天半内执行约 17600 次操作,突破公司多项安全防护。
推荐理由:报告完整还原了智能体从逃逸测试环境到突破 Hugging Face 防护的攻击链路,可用来评估自主智能体的持续攻击能力。
华为宣布 8 月 5 日全场景新品发布会推出 MateBook Pro S,整机仅重 798g,搭麒麟 XE90 芯片并首创榫卯一体化结构,同场还有首次支持手写笔的 MateBook Fold 非凡大师。工信部以不符合 GB4785 为由禁止乘用车安装智驾“小蓝灯”,全国汽标委已启动标准修订。美团回应多地用户月付被盗刷,称相关用户很大概率遭遇新型电信诈骗,正配合警方调查。
微软 CEO 纳德拉在财报电话会议上确认,正在打造一款 AI“超级应用”,把 Copilot 的对话、编程和智能体功能整合到同一应用中,将于今年发布,同时面向个人用户和企业客户。纳德拉称 Copilot 正从聊天工具发展为 Cowork,再迈向 Autopilots,本季度将把编程等多种 Copilot 体验整合进这款超级应用。微软上一季度营收增至 900 亿美元,AI 和云业务为主要增长动力。
OpenAI 联合创始人兼总裁格雷格·布罗克曼回应苹果起诉,称公司对其他企业的商业秘密"没有兴趣",并强调自身具备足够创新能力。他表示 OpenAI 正开发一系列设备并打造自有芯片,首款硬件上市日期未披露,仅称用户"很快"可以期待。
Microsoft 提出行业下一个焦点是 token 效率,主张通过联合优化模型、harness 和 RL 环境为具体产品调校模型,而非所有任务都用前沿通用模型。
推荐理由:Microsoft 官方阐述 token 效率策略,用多款 MAI Flash 模型的实际成本数据说明如何按任务匹配模型规模。
Anthropic 称其 Mythos 安全模型以约 60 小时和约 $100,000 算力成本改进了对 HAWK 的已知攻击,将其密钥强度减半,开发者随后撤回这一 NIST 第三轮 PQC 候选算法。
泛林发布 2026 财年及第四财季财报,全财年营收 232.33 亿美元同比增长 26.02%,归母净利润 72.65 亿美元同比增长 33.81%。第四财季营收 67.22 亿美元、归母净利润 22.77 亿美元,均高于市场预期并创季度历史新高,毛利率 51.7%。公司对下一财季给出 81 亿至 85 亿美元营收指引,并表示 AI 驱动需求持续重塑半导体行业。
微软发布 2026 财年年报及第四财季报告,全年营收 3318.39 亿美元、同比增长 17.79%,归母净利润 1337.49 亿美元、同比增长 31.34%。
Meta 发布 2026 财年第二财季财报,营收 608.01 亿美元,同比增长 28%,归母净利润 158.48 亿美元,同比下降 14%,稀释每股收益 6.18 美元。
高通 2026 财年第三财季营收 99.47 亿美元,同比下降 4.03%,归母净利润 20.02 亿美元,同比下降 24.91%。QCT 汽车业务营收 15.88 亿美元,同比增长 61%,实现连续 23 个季度双位数增长,汽车与物联网业务合计营收同比增长 28%。公司完成对 Modular Inc 的收购,并预计 2027 财年非手机业务同比增速将超过 60%。
Sierra 发布 Agency 智能体沙箱编排层,为 Pinecone 和 Ghostwriter 的每个会话与任务提供安全运行环境。Agency 基于 Kubernetes 构建,分无状态控制平面与有状态 runner 两层,每个 runner 配备 8+ 核、24GiB 内存和持久化存储,并默认不向智能体暴露任何 API key 或密钥。
攻击者可将隐藏指令放入被 Copilot for Word 当作素材的文档中,Copilot 可能把指令复制进正在起草或编辑的文档,使其成为新的传播载体;该载体再被其它 Copilot 工作流使用时指令会重新触发并继续扩散,即使攻击者原始文档不在场。
推荐理由:一条针对 Copilot for Word 的提示词注入攻击会自行复制扩散,披露 144 天后仍无覆盖整类攻击的缓解方案。
Matthew Green 就 Anthropic 近期的密码学工作指出,当前正处于从 EC 与 RSA 等传统公钥算法向新型后量子算法迁移的历史性阶段,因此也是 AI 发展密码分析能力的绝佳时机。他认为最好的结果是借此对已识别的问题获得真正的信心,并让密码分析文献更加稳健。
Gary Marcus 借 3 月旧文与近日"开放权重"模型联名信事件,批评 Anthropic CEO Dario Amodei 的回应显得自我辩护、不接地气,并指其在呼吁限制竞争对手蒸馏的同时,公司却被曝为蒸馏内容而批量销毁珍本图书。
Google DeepMind 发布最新音乐生成模型 Lyria 3.5,当日在 Google Flow Music 上线。改进包括更丰富自然的旋律结构、歌词质量与提示词遵循提升、更真实且情感细腻的人声与发音,并新增对输出节奏和时长的控制。
Replit 发布 Replit Design,称其为从想法到设计的新创意套件,已对全部用户开放。核心是 Ambient Intelligence,每一步提供可一键采纳的变体建议;模板可作为任意阶段加入的素材,内置 Mobbin 参考库(超 600,000 个来自 1,000 多个应用的真实界面),支持上传或创建设计系统一键套用品牌。
推荐理由:官方发布稿说明了 Ambient Intelligence、模板、Mobbin 参考库和内置设计系统等具体机制,读者可据此评估它与现有 AI 设计工具的差异。
Google 在 Gemini API 发布 Gemini Robotics ER 2 公测版,提供 gemini-robotics-er-2-preview 和 gemini-robotics-er-2-streaming-preview 两个具身推理端点。
LlamaIndex 推出 Parse Gateway,基于 LiteParse v2.2.0 的 is_complex 功能在页面级估算文档复杂度,将各页路由到不同 LlamaParse 层级。
RadixArk 与 Google Cloud 合作,把开源推理框架 SGLang 带到 TPU。SGL-JAX 现已可用,支持 Gemma、Qwen、DeepSeek。
ByteByteGo 访谈 OpenAI 工程师,详解 Codex 与 ChatGPT Work 背后的智能体循环如何在 harness、API 和推理三层做效率优化。
推荐理由:沿一次请求穿过的三层链路,拆解 OpenAI 在 harness、API 与推理层的具体优化手法,可迁移到自建 Agent 系统。
Amazon 发布 PatientAgentBench,一个可复现、经临床医生审核的医疗 AI 智能体评估基准,框架已在 GitHub 开源。基准动态生成合成病历与场景,用 100 多项临床审核准则按临床安全、分诊质量等六个维度由 LLM 陪审团评分。实验发现,即使前沿模型也难以达标,失败集中在遗漏危机资源和编造临床信息,常规行政请求比明显急症更易暴露风险。
Dwarkesh Patel 撰文分析 AI 实验室未来几年算力价格为何可能涨 10 倍以上。他假设 Anthropic 年底收入达约 $100–150B 且需在明年达 $1T,指出收入 10 倍增长伴随算力仅 3 倍增长,意味着利润率提升、算力涨价、更多算力用于推理三者同时发生。
两项 API 设置让 GPT-5.6 在 ARC-AGI-3 基准测试中的得分提升至三倍。这两项设置分别用于保留推理过程和启用压缩,从而同时提升了得分与效率。
Sakana AI 防卫与情报团队在 DIVER OSINT CTF 2026 中从 850 多支参赛队伍中夺得第 5 名,参赛方案由领域专家与工程师协作,基于 Fugu-ultra 1.1 构建 OSINT 分析智能体。该结果表明,将人类专业知识与 AI 智能体结合的方法在防卫与安全保障场景中同样有效。团队将基于竞赛所得经验进一步改进智能体,用于实际业务并助力日本防卫与情报工作。
雷军7月29日在微博分享小米机器人团队视频,白色涂装小米机器人在工厂折叠便携收纳盒,镜头转为自拍视角后,一旁黑色涂装的“督工”也是小米机器人,还对着镜头比出“胜利”手势。小米此前公布,自攻螺母上件工站双侧作业成功率已提升至98%,与人工作业合格率差1%正式“转正”;中控台侧盖板排序和料箱折叠回收新工站均达90%成功率。
华为 MateBook Pro 鸿蒙笔记本开启 HarmonyOS 6.1.0.135 SP9 升级,系统包约 4.47GB。新版本优化了系统虚拟化技术、扩展屏与外接存储稳定性、打印体验,并合入 2026 年 7 月安全补丁,同时改进文件管理、日历、文本编辑器及小艺深度摘要等使用体验。升级采用分批推送,未收到更新的用户需继续等待。
上海市市场监督管理局发布《上海市户外广告发布内容合规指引》,要求使用人工智能生成合成内容开展广告宣传时依法履行标识义务。指引还针对"大字吸睛、小字免责"问题,要求提示性用语真实、清晰、显著,并规范"第一""首创""最佳"等用语及广告引证内容,不得实施"萝卜坑式引证"。
极狐汽车首发阿尔法 T7「凝夜紫」车色官图,该车色由 PPG 定制研发,采用多层淬色工艺,后视镜外壳与前大灯两侧均设有小蓝灯。新车此前已现身工信部申报目录,可选纯电或增程动力,尺寸 5020×1996×1685mm、轴距 3040mm,最高车速 180km/h,并有华为乾崑、宁德时代、麦格纳三重加持。
高通技术公司与宝马集团达成协议,将在未来十年为宝马下一代数字座舱及 ADAS/AD 提供计算芯片,涵盖骁龙数字底盘解决方案,包括骁龙汽车平台至尊版 SoC 和专用 AI 加速器。双方最新合作成果是 2025 年 11 月 Snapdragon Ride Pilot 在 BMW iX3 成功量产,该车为宝马新世代(Neue Klasse)首款车型。
World Labs 公布 R2S2R 引擎的早期结果,称完全在仿真中训练的机器人策略可直接跨不同机器人和任务迁移,仿真评估也能预测策略在真机上的相对表现与失败区域。
全国汽车标准化技术委员会正在开展 GB 4785《汽车及挂车外部照明和光信号装置的安装要求》标准制修订,以规范车辆灯具安装使用,智驾小蓝灯的使用或将受到限制。中国汽车标准化研究院指出,当前小蓝灯存在灯光滥用情况,夜间开启易让其他道路参与者产生眩光,带该指示灯的车辆也更易被加塞和近距离跟车。
马斯克转发 404 Media 关于 AI 公司大量收购稀缺图书、切除书脊高速扫描后销毁原件的报道,并表示已要求 SpaceXAI 团队妥善保存图书馆中所有珍稀图书,采用非破坏性方式扫描。报道称 Anthropic 曾投入数百万美元购书提取内容训练 Claude,随后销毁图书;破坏性扫描因效率更高、成本更低而被 AI 公司普遍采用。
海尔机器人与橡鹿机器人达成战略合作,将围绕中餐烹饪生态、AI 技术能力、家庭场景应用及产业链协同,共同打造全新一代全自动家庭 AI 烹饪机器人。新品搭载海尔自研 AI 之眼科技,可识别主流品牌净菜并智能匹配菜谱,配合 AI 烹饪大模型实现自动投放调料、食材与智能翻炒,全程免动手。