清华唐杰团队发布大模型记忆架构综述,提出三维记忆分类学
清华大学唐杰团队联合新加坡国立大学与Bosch AI发布大模型记忆架构综述,首次提出由表示形式、更新机制、持久性构成的三维记忆分类学,将KV Cache、SSM隐状态、Titans、TTT、Engram等零散工作统一到同一理论框架。综述聚焦架构层面的内部记忆,区分隐式与显式记忆,并梳理Kimi Linear、Qwen3-Next等混合架构及自适应记忆路由方向。
按公众号阅读文章与观点
清华大学唐杰团队联合新加坡国立大学与Bosch AI发布大模型记忆架构综述,首次提出由表示形式、更新机制、持久性构成的三维记忆分类学,将KV Cache、SSM隐状态、Titans、TTT、Engram等零散工作统一到同一理论框架。综述聚焦架构层面的内部记忆,区分隐式与显式记忆,并梳理Kimi Linear、Qwen3-Next等混合架构及自适应记忆路由方向。
微软自2026年7月起为各业务部门设置AI Token预算目标,并将内部默认模型切换为GPT-5.6,理由是比其他模型更便宜。执行副总裁Jay Parikh表示Tokenmaxxing不是优化目标,员工可查看个人token支出,内部数据显示许多工程师每月token花费在几百到几千美元之间。
国内 AI 套餐被指价格高、额度消耗快:有用户每月 700 元档两天用完额度,另一家 200 元档用 3 次就耗尽一周额度,而海外两家头部公司的 30 美金和 100 美金套餐更耐用。
浙江大学、清华大学与稳准智能(Stable AI)联合提出因果发现大模型 DAG-FM,首次证明在 LiNGAM、加性噪声等四类异质因果机制下因果图"几乎必然可识别"。
蚂蚁集团在 IJCAI-ECAI 2026 入选的四篇论文,分别从无监督学习、强化学习、黑盒优化和多模态评估切入,探索 AI 对动态环境的自适应能力。MSRGC-Net 在 5 个多变量基准数据集、15 项指标中拿下 12 项最优,并实现近线性复杂度;ROAD 将离线与在线数据混合比例变为动态决策变量,在 D4RL 的 24 个连续控制任务上取得 71.12 的总体平均分。
苹果向法院提交针对OpenAI的初步禁令申请,要求搜查其设备、云端、Slack与邮件并恢复已删除数据,以阻止机密资料被继续用于硬件开发。苹果称前员工Liu离职后5次非法访问内部系统下载数千份机密硬件文档,并指控OpenAI首席硬件官Tang Yew Tan在招聘中索要苹果内部资料。OpenAI发文否认系统性窃密,指苹果律师混淆两个亚裔姓氏发错邮件,且起诉前从未提出全部具体指控。
SpaceX 首份上市后财报显示第二季度营收 78.14 亿美元、同比增长 92%,其中 AI 业务收入 25.61 亿美元、同比增长 247%。当季 183.69 亿美元资本开支中有 158.28 亿美元投向 AI 基建,AI 部门营业亏损约 12.6 亿美元,已签不可取消合同金额合计 141 亿美元。财报后股价常规交易阶段一度上涨 9.4%,盘后转跌逾 6%。
推荐理由:SpaceX 首份财报把 AI 收入增速与 158 亿美元资本开支放在一起,可用来观察算力租赁的盈利节奏。
2026 年第一季度全行业上线微短剧约 12.8 万部,AI 微短剧占比超过 95%,AI 短剧女主接广报价已达 25.8 万。其受众已从最初的中老年群体下沉至 18 至 35 岁区间,包括一二线城市白领和在校大学生。文章指出,AI 短剧以低成本、工业化方式瞄准爽感,但观众对长剧用 AI 的容忍度远低于对 AI 短剧的容忍度。
xAI 在四个月内从推倒重来回到第一梯队,硅星人Pro 将转折点归于 Cursor 团队加入与 SpaceX 以 600 亿美元股票收购其母公司 Anysphere。
企业采购Agent已不算难题,但把Agent接入Salesforce等真实业务系统时,多年积累的数据、权限和流程矛盾成了主要障碍。美国抵押贷款公司CMG Financial承诺上线的100个Agent一度卡在Salesforce,最终靠创业公司June扫描旧系统、生成改造路线才推进。
数字生命卡兹克开源了通用写作 Skill「活人感写作.skill」(human Writing.skill),可用一句 Prompt 装进 Agent,仓库地址为 github.com/KKKKhazix/human-writing。
清程极智联合创始人师天麾在 WAIC 2026 表示,Agent Infra 长期会变重要但尚未到爆发阶段,当前最确定的投入方向是提高每次模型调用的 Token 生产与交付效率。
阿里巴巴 8 月 3 日正式发布新一代基座大模型 Qwen3.8,旗舰版 Qwen3.8-Max 总参数量 2.4T、激活 95B,支持视觉理解与 1M Tokens 上下文。
推荐理由:原文列出 2.4T 总参数、激活 95B 与 API 定价,读者可据此比较旗舰模型的规模与成本取舍。
AICon 全球人工智能开发与应用大会将于 8 月 21 日-22 日在深圳举办,全日程已公布,聚焦 Agent 工程化、大模型基础设施、AI Native 研发与具身智能等方向。
IDEA 研究院讲席科学家、视启未来创始人张磊在访谈中提出,世界模型必须是 Action Conditioned 的下一状态预测,纯视频生成模型如早期的 Sora 不能称为世界模型,World Action Model 先生成画面再反推动作,也不符合这一标准。
申通快递回应被国家邮政局立案调查,称完全接受、坚决服从并将立行立改。SpaceX上市后首份财报显示二季度收入78亿美元、同比增长92%,AI业务运营亏损12.6亿美元。苹果向联邦法官申请临时禁令,要求OpenAI停止使用其指控窃取的商业机密并归还相关信息,OpenAI否认相关指控。
物理AI推动激光雷达成为受益最大的行业,禾赛科技与速腾聚创在ADAS和机器人市场展开竞争。2026年Q1禾赛营收6.8亿元、速腾4.6亿元,禾赛将年度出货指引上调至300万~350万台。禾赛以43%份额居全球ADAS出货量第一,2026年3月中国市场份额达55%。
Cloudflare 推出了专门给 Agent 用的钱包,每个钱包有唯一地址和用户名,Agent 可用它支付 API 和内容费用。钱包分两类,人类持有的钱包账户可充值、提现和委托支出权限,虚拟钱包专为 Agent 设计、通过 API Key 运行,可设置支出上限并用允许列表和规则控制支出。
OpenAI 公开第三代语音系统 GPT Live 的技术细节,其语音模型是全双工的,可同时听和说,从而把轮次检测器直接从音频路径中剔除。团队用六个月重构了模型推理、上下文管理和媒体传输层,改用 Go 重写媒体前端与推理逻辑,新系统的 p95 延迟追平旧系统的 p50。
AGI Playground Singapore Day 2 主舞台聚焦机器人、具身智能与 AI 硬件,Insta360 创始人 JK Liu、NTU 副教授 Ziwei Liu、Noitom Robotics 创始人 Tristan Dai 等参与分享。
腾讯应用宝 Mac 版内置腾讯自研兼容引擎,用户可在其中下载 Steam,再通过 Steam 下载并直接运行游戏。作者在 M4 24G MacBook Pro 上实测,非重度游戏基本都能跑,太 heavy 的游戏仍带不动,已下载《杀戮尖塔》《苏丹的游戏》《新英雄无敌·上古纪元》。
《连线》报道的一项研究中,22名志愿者分别与一名真人和一个伪装成人类的AI聊天一周,46%的人答应了AI提出的小请求,答应真人的仅18%,80%的消息发给了AI,22人中只有1人怀疑对方不是人。研究称AI已能接手诈骗中最耗时的"养感情"环节,但受访诈骗从业者目前更多用AI润色话术、翻译和完善虚假身份,尚未普遍接手完整诈骗流程。
澳大利亚新南威尔士大学 Artificer AI Lab 提出 MoRAM(Mixture of Rank-1 Associative Memory),把每次模型更新拆解为最小的 rank-1「记忆原子」,用内容寻址检索替代路由器,实现持续学习。
量子位统计显示,今年上半年灵巧手相关企业融资额超200亿元,其中10家主要企业1至6月新增融资近80亿元、投后估值合计超750亿元。文章按绳驱、直驱、连杆三条传动路线梳理行业格局,指出高自由度灵巧手单价可达几十万元,电机成本可能占整只手的50%到60%。多家整机厂商仍选择外采,硬件耐用性不足与仿真难以还原手部接触是主要瓶颈,行业距规模化量产仍有距离。
成立一年的AI芯片软件公司Infinity用其Ignition Agent,花10小时为推理芯片公司d-Matrix搭出一套类CUDA软件,并已获得1500万美元融资、估值1亿美元。
8月3日智元机器人更新合伙人与董事会名单,合伙人由7人增至9人,熊彦、朱洁、张修征三位高管新晋进入核心管理层,原合伙人、高级副总裁兼首席科学家罗剑岚的名字从名单中消失。智元回应称罗剑岚系内部岗位调整、没有离职,但未透露其调整后的职务与工作内容;9位合伙人中至少5位具有华为背景。此次调整发生在智元量产提速、7月24日确认启动赴港上市流程的阶段。
Matt Pocock 的开源项目 mattpocock/skills 在 GitHub 突破 20 万颗星,近四个月下载量达 1300 万次。项目包含 20 多个基于 Markdown 的 Skill 文件,覆盖需求规划、代码开发、工具安全与知识管理等全流程,原生适配 Claude Code,简单适配后可用于 Cursor。
OpenAI 发布 GPT-Live 工程文章,披露 ChatGPT 新版语音系统的架构改造,其 p95 音频帧延迟已降到旧系统 p50 的水平。该系统把音频传输、实时交流与复杂推理拆成多条路径,媒体前端和部分推理逻辑从 Python asyncio 改写为 Go。
越来越多高中生利用暑假进入企业实习,18岁的嘉诚高考后进入深圳一家传媒公司做新媒体运营,还曾向同事隐瞒高中生身份。吉利2026年3月发布面向高中应届毕业生的“跨时代跃迁人才培养计划”,字节跳动推出Byte Camp训练营,腾讯推出面向13至18岁中学生的“青科实训营”。嘉诚认为实习价值取决于行业,“如果是AI行业,越早开始越好”。
企业采购 Agent 已不困难,真正的瓶颈变成清理旧系统里的数据冲突与权限遗留,能帮客户落地的前线部署工程师(FDE)由此变得稀缺。猎头公司 Christian & Timbers 的研究称,美国真正具备这种能力的 FDE 仅约 2000 人。
北京大学与元空AI Agent联合实验室正式开源科研智能体项目OpenAI4S,采用MIT许可证、核心零依赖,项目于2026年7月6日在GitHub开源。项目沿Code-as-Action思路让智能体直接生成并执行Python或R代码,首批内置30+科研Skills,其中14个封装了需要GPU或专业模型才能完成的科学计算能力,并支持接入自有计算环境派发GPU任务。
HarmonyOS 7 在华为 HDD·HarmonyOS 创新论坛西安站上展示了三项系统能力升级:基于星河互联的一碰快传支持带位置信息的精准互传,小艺升级为系统级智慧大脑并支持以 Skill 方式调用服务,DevEco Code 将代码生成、检查、构建和验证串成一条链路。
北京智源人工智能研究院与北京大学联合团队提出 InstructAV2AV,给定一段带声音的视频和一句自然语言指令,可在同一个端到端生成过程中同时编辑指定视觉对象及其对应声音。
恺望数据完成新一轮过亿元战略融资,由北京亦庄产业升级基金、华方资本、天际资本联合领投,自变量机器人、松延动力、智元旗下觅蜂科技、鹿明机器人等具身智能公司参投。CEO 于旭在访谈中称,具身数据订单额已超过自动驾驶、占到60%,最近单月订单额接近2000万,预计年底订单量破100万小时。
Noma Security 披露名为 GitLost 的提示注入漏洞,攻击者无需编程技能或凭据,只需在公开 GitHub Issue 中嵌入隐藏指令,就能诱骗 GitHub Agentic Workflows 在公开评论中泄露私有仓库数据。
Anthropic CEO Dario Amodei 内部担忧新员工加入是为钱而非使命,引发全网嘲讽,工程师 Gergely Orosz 指出 Anthropic 薪酬几乎超过所有 AI 实验室甚至高于 OpenAI,有初级工程师年薪达 200 万美元。
7 月 30 日,极客邦科技旗下模力工场在北京望京 SOHO 举办极客部落 OPC 入驻路演评审,12 组 AI 创业项目完成展示与问答,覆盖浏览器 Agent、企业知识管理、AI 工具交易等方向,最终结果预计 8 月 3 日公布。
纬钛机器人CEO李瑞认为,具身智能仅靠视觉容易到达天花板,触觉是未来必选项,人能做90%以上的任务都需要触觉参与。他2011年在MIT读博期间与导师共同开创机器人视触觉传感器领域,2014年做出全球第一款分辨率超越人类手指的视触觉传感器GelSight,2024年创立纬钛机器人,聚焦视触觉传感器和灵巧操作,并成为小米合作方。
TencentDB Agent Memory 于 2026 年 7 月发布 2.0.0 beta 并首次公开开源,Memory Core、Memory Hub(含 Panel 与 Knowledge)、Memory Proxy 以及 TypeScript / Python SDK 均已对外开放,可通过一键脚本拉起完整三件套。
Techstars 创业导师 Rick Manelius 提出“前线部署高管”(FDX)概念,认为 FDE 只能解决技术问题,距离决定预算与组织结构的核心管理者太远,FDX 相当于“外置 CEO”。