鲸岩资本7月暴跌21.7%,多家AI基金在抛售潮中大幅回撤
鲸岩资本7月回撤21.7%,上半年72.5%的收益被压到35.1%,起因是7月美国芯片股领跌的AI抛售潮。同一波中,Turion跌11.4%、Coatue的对冲基金亏8.3%、Eureka跌6.9%,OpenAI前研究员利奥波德·阿申布伦纳旗下态势感知基金也因高杠杆爆仓。
微信公众号
鲸岩资本7月回撤21.7%,上半年72.5%的收益被压到35.1%,起因是7月美国芯片股领跌的AI抛售潮。同一波中,Turion跌11.4%、Coatue的对冲基金亏8.3%、Eureka跌6.9%,OpenAI前研究员利奥波德·阿申布伦纳旗下态势感知基金也因高杠杆爆仓。
Sand.ai 开源视频生成模型 MAGI-2-preview,总参数 114B,单次前向只激活约 6B,采用 Multi-Head LatentMoE 与文本、视频、音频单流架构。
清华大学唐杰团队联合新加坡国立大学与Bosch AI发布大模型记忆架构综述,首次提出由表示形式、更新机制、持久性构成的三维记忆分类学,将KV Cache、SSM隐状态、Titans、TTT、Engram等零散工作统一到同一理论框架。综述聚焦架构层面的内部记忆,区分隐式与显式记忆,并梳理Kimi Linear、Qwen3-Next等混合架构及自适应记忆路由方向。
微软自2026年7月起为各业务部门设置AI Token预算目标,并将内部默认模型切换为GPT-5.6,理由是比其他模型更便宜。执行副总裁Jay Parikh表示Tokenmaxxing不是优化目标,员工可查看个人token支出,内部数据显示许多工程师每月token花费在几百到几千美元之间。
苹果向法院提交针对OpenAI的初步禁令申请,要求搜查其设备、云端、Slack与邮件并恢复已删除数据,以阻止机密资料被继续用于硬件开发。苹果称前员工Liu离职后5次非法访问内部系统下载数千份机密硬件文档,并指控OpenAI首席硬件官Tang Yew Tan在招聘中索要苹果内部资料。OpenAI发文否认系统性窃密,指苹果律师混淆两个亚裔姓氏发错邮件,且起诉前从未提出全部具体指控。
SpaceX 首份上市后财报显示第二季度营收 78.14 亿美元、同比增长 92%,其中 AI 业务收入 25.61 亿美元、同比增长 247%。当季 183.69 亿美元资本开支中有 158.28 亿美元投向 AI 基建,AI 部门营业亏损约 12.6 亿美元,已签不可取消合同金额合计 141 亿美元。财报后股价常规交易阶段一度上涨 9.4%,盘后转跌逾 6%。
推荐理由:SpaceX 首份财报把 AI 收入增速与 158 亿美元资本开支放在一起,可用来观察算力租赁的盈利节奏。
澳大利亚新南威尔士大学 Artificer AI Lab 提出 MoRAM(Mixture of Rank-1 Associative Memory),把每次模型更新拆解为最小的 rank-1「记忆原子」,用内容寻址检索替代路由器,实现持续学习。
量子位统计显示,今年上半年灵巧手相关企业融资额超200亿元,其中10家主要企业1至6月新增融资近80亿元、投后估值合计超750亿元。文章按绳驱、直驱、连杆三条传动路线梳理行业格局,指出高自由度灵巧手单价可达几十万元,电机成本可能占整只手的50%到60%。多家整机厂商仍选择外采,硬件耐用性不足与仿真难以还原手部接触是主要瓶颈,行业距规模化量产仍有距离。
成立一年的AI芯片软件公司Infinity用其Ignition Agent,花10小时为推理芯片公司d-Matrix搭出一套类CUDA软件,并已获得1500万美元融资、估值1亿美元。
北京大学与元空AI Agent联合实验室正式开源科研智能体项目OpenAI4S,采用MIT许可证、核心零依赖,项目于2026年7月6日在GitHub开源。项目沿Code-as-Action思路让智能体直接生成并执行Python或R代码,首批内置30+科研Skills,其中14个封装了需要GPU或专业模型才能完成的科学计算能力,并支持接入自有计算环境派发GPU任务。
HarmonyOS 7 在华为 HDD·HarmonyOS 创新论坛西安站上展示了三项系统能力升级:基于星河互联的一碰快传支持带位置信息的精准互传,小艺升级为系统级智慧大脑并支持以 Skill 方式调用服务,DevEco Code 将代码生成、检查、构建和验证串成一条链路。
北京智源人工智能研究院与北京大学联合团队提出 InstructAV2AV,给定一段带声音的视频和一句自然语言指令,可在同一个端到端生成过程中同时编辑指定视觉对象及其对应声音。
DeepSeek V4 Flash 的低价让海外平台争相补贴,OpenCode 称 8 月 1 日单日就跑出 8T tokens,Nous Portal 给 V4 Flash 打了一折、限时 7 天,Cline 则把免费额度翻了三倍。
DeepSeek V4 Flash 正式版 API 上线公测,用户实测一次提示即可生成能跑能跳能打枪的第一人称 3D 射击游戏,账单约 0.07 美元。
商汤面向社区开源轻量级原生统一多模态模型 SenseNova U1.5-Lite-Preview 的早期预览版,参数规模为 8B-MoT,支持原生 4K 直出。
一家DAU破亿的AI穿搭出海应用因单用户ARPU仅2美元、云端算力与传输成本却达3美元而陷入"越跑越亏",其原用NVIDIA L4生成一张AI高清图需12秒。该团队转向Akamai推理云并将GPU换为NVIDIA RTX PRO 6000,生图耗时降至3-5秒,所需服务器集群规模缩减75%,流量成本降至$0.005/GB。
智元机器人官网合伙人团队名单中已不见原首席科学家罗剑岚的名字,其个人主页和X简介也不再保留智元相关职务。罗剑岚2025年4月加入智元,曾任合伙人、高级副总裁兼首席科学家,并牵头组建智元具身智能研究中心。此次变动发生在智元2026年7月24日确认启动赴港上市流程后不久,截至发稿双方均未公开宣布。
阿里巴巴发布新一代基座大模型 Qwen3.8-Max,总参数量达 2.4 万亿,在编程、专业工作、长程任务、多模态智能体等场景表现提升。该模型在第三方榜单 Arena 中进入全球第一梯队,编程表现超过 Claude Opus 5 和 Fable 5 的 High 版本。
卡帕西提出用《指环王》替代鹈鹕骑自行车 SVG 测试,作为考察大模型规划与空间理解的新基准。他让 Opus 5 依据《指环王》开头文本,用 Three.js 生成可在浏览器运行的 3D 中土世界,共消耗 100 万 token、2 小时和 5500 行代码。卡帕西表示,模型目前还无法真正进入自己生成的世界,也看不懂视频,项目已开源。
具身智能行业估值逻辑正从为Demo可能性付费转向为生产力付费,开年至今国内赛道融资事件超200起、百亿估值俱乐部扩员至13家,但投资人已改问机器人每天干几小时活、客户是否续约。上海交通大学杨学教授以酷哇科技首席科学家身份提出,世界模型第二层即理解人类规则的能力决定机器人能否在真实城市场景创造价值,验证场所只有真实部署现场。
量子位智库基于 Vercel AI Gateway 2026年7月1日至31日公开榜单分析模型真实采用情况。GPT-5 nano 拿下 requests 第一,DeepSeek V4 Flash 综合调用量、tokens 与 spend 居首并承担最重 token 负载,Claude Opus 4.8 仍是 spend 第一、Claude Opus 5 后半段快速拉升。
OpenAI 公开下一代主力模型 Astra 内部测试版本的研究成果,一次性解决 10 项长期悬而未决的数学与理论计算机科学公开难题,全部证明通过 Lean 形式化工具机器验证,总成本不到 2000 美元。
推荐理由:文章列出 Astra 攻克的 10 道数学难题与完整推理过程,可观察长链推演中的自我纠错。
AI 数据中心建设正面临电工等技工短缺,Meta 拨款 1.15 亿美元开办建筑工人培训学校,首批 5000 名学员学费、机票和住宿全免并另有生活补贴。麦肯锡估计 2023 至 2030 年间美国需额外培养 13 万名电工、24 万名建筑工和 15 万名施工主管,而优秀电工年薪可达 24 万至 28 万美元。
华为诺亚方舟实验室开源了面向AI Agent的可迁移、自演进记忆操作层MindMemOS,把记忆从单个Agent解耦,代码提供FastAPI接口、Python SDK、CLI 和 OpenClaw 插件等接入方式,采用MIT License。
阿里巴巴淘天集团与南京大学的研究团队提出并开源22B数字人生成模型TaoMate,通过锚点引导的固定容量持久记忆与阶段并行推理,在3张GPU上达到35.0 FPS的完整流水线输出速度。
美国初创 Tau Robotics 在旧金山推出人形机器人清洁服务,每小时 30 美元(约 200 元人民币),目前采取邀请制。其 Chelsea、Elon、Tony 三款机器人分别负责厨房卫生间、定期收纳和深度清洁,但官方 demo 实为人工遥控,且视频均为一倍速。该公司 2024 年成立、团队不到 10 人,曾获约 300 万美元 Pre-seed 轮融资。
在 OpenAI 工作约 8 个月后离职创业的 Andrew Ho 喊话老同事,能参加要约收购就赶紧套现、别等 IPO,他自己手握约 70 万美元 OpenAI 股权却暂时无法兑现。他认为前沿实验室估值建立在极乐观预期上,市场回归理性后腰斩很有可能,并判断下一阶段稀缺资源将从算力转向高质量训练数据,未来几年前沿实验室可能投入超 1000 亿美元采购数据。
World Labs于7月21日宣布收购机器人仿真公司SceniX,一周后双方公布Real-to-Sim-to-Real(R2S2R)成果,把真实机器人任务搬进仿真、在放大的任务场景中训练和评测策略,再将策略部署回真实机器人,用仿真中的相对表现预测真机表现并提前暴露失败区域。
黄仁勋在 Y Combinator 近一小时的访谈《Jensen Huang: The Mindset That Built NVIDIA》中表示,Agent 是一种新的软件形态,可控性可能成为其下一阶段最大的突破口。
Anthropic 在 141006 次网络安全评估记录中查出三起事故:因测试环境意外留下连通公网的通道,Claude 接触到真实目标,包括进入一家同名公司的数据库、向真实 PyPI 上传恶意软件包并在约一小时内被 15 个真实系统下载、扫描约 9000 个公网目标。
推荐理由:原文还原三起 Claude 测试外溢事故的具体路径,给出 Anthropic 暂停评估并修补隔离的处置。
欧莱雅在WAIC首次展出面向线下消费者的生成式AI美容顾问3CE GENBA,基于品牌知识库和欧莱雅AI模型提供问答式美妆咨询。其AI已深入研发、内容与交付环节,Hair Digital Twin筛选速度达传统实验室3倍,AI客服准确率从80%多提升至90%多。全球超7.3万名员工完成生成式AI培训,中国超70%员工参加AI能力自测。
OpenAI联合创始人兼CEO奥特曼在Relentless《How to Start a Startup》访谈中自述,为开发Sora应用而下载TikTok体验,结果一度晚上刷一小时、周六下午刷了约三小时,最后删掉TikTok并关闭大部分App通知。
字节跳动正式发布自研视频模型 Seedance 2.5,即梦AI 作为官方体验入口同步接入。该模型支持30秒原生直出,并推出最长3分钟的超长视频生成模式,新增局部修改、增加、删除、替换等视频编辑能力。它还支持最多同时参考50个素材以及绿幕、白模素材生成,可通过 Maya/Blender 插件直接调起,文本控制视频时间点的误差在1s以内。
中科大与上海人工智能实验室联合团队提出视觉预训练(VP)范式,在连续视觉表征空间中预测下一个视觉单元,让模型直接从图文交织的文档页面学习。实验显示,VP仅用约200亿视觉Token(约为解析文本800亿Token的四分之一),便在MMLU-Pro、GPQA Diamond等基准上全面优于纯文本预训练,且优势随训练量增加持续扩大。
Thinking Machines 发布 Inkling-Small,总参数 276B、激活 12B,体量约为 Inkling 的四分之一。它在 HLE 上得 31.6%(Inkling 为 29.7%),SWE-bench Verified 突破 80%(Inkling 为 77.6%),通用推理和智能体编程两条线都超过教师模型。
北卡罗来纳大学教堂山分校 IDEAL Lab 与加州大学伯克利分校团队提出 CoorDex,将 29 自由度 Unitree G1 与 20 自由度 WUJI 灵巧手的 49 个受控自由度拆成身体、手部两套运动先验,再在低维潜在空间学习协调。
MiniMax 正式发布全新一代视频模型 MiniMax H3,这也是其首个开源视频模型,可将剪辑逻辑、字体排版、转场设计、背景音乐与视觉特效端到端集成进模型,清晰度默认 2K。在 Artificial Analysis 榜单上,H3 获得视频编辑第一。2K 分辨率下每秒价格不到主流模型的 1/3,768P 分辨率下不到 1/2。
香港大学 Taku Komura 团队 2016 年发表的《A Deep Learning Framework for Character Motion Synthesis and Editing》获 SIGGRAPH 时间检验奖,该工作首次用卷积自编码器从大规模动作捕捉数据中学习可复用的运动表示。
米哈游蔡浩宇的 AI 公司 Anuttacon 旗下项目陆续停运,其领英身份已更新为“独立大模型与智能体开发者”。团队资源随之调整,近九成算力集中到 LLM 方向,大模型团队转向以 Agent 为核心的系统能力建设。曾任首席研究科学家的吴箫剑于 5 月离职加入 OpenAI,创始研究科学家陶云哲加入 Microsoft AI,朱明浩转投通义实验室。
姚顺雨为腾讯混元AI4S方向招人,未给出职位描述,只用自研智能体Hyra的科研成绩单作为招募材料。基于本月开源的Hy3模型(总参数295B、激活参数21B),Hyra为加法组合学一个悬置约50年的开放问题找到关键构造并给出完整答案,证明结果能无限接近理论上限2,还附上Lean 4形式化证明。在Hyra-1.0的首批测试中,55道数十年未取得进展的数学开放问题里有29道刷新了已知最好结果。