西湖大学提出 BudCache:固定预算下离线搜索扩散模型缓存策略
西湖大学 AGI 实验室提出 BudCache,一种面向固定计算预算的扩散模型 step-level cache 方法,先固定 NFE 预算再离线搜索最优缓存策略,而非运行时靠启发式阈值临时决策。
微信公众号
西湖大学 AGI 实验室提出 BudCache,一种面向固定计算预算的扩散模型 step-level cache 方法,先固定 NFE 预算再离线搜索最优缓存策略,而非运行时靠启发式阈值临时决策。
量子位面向 AI 产业、AI 财经、AI 产品三大方向招聘全职编辑作者,岗位覆盖编辑、主笔、主编,社招与校招均可,工作地点为北京中关村。应聘者需将简历及代表作品发送至 zhaopin@qbitai.com,邮件主题注明“量子位XX方向应聘 - 姓名”。
阿里妈妈联合清华大学提出强化学习后训练增强版生成式出价算法 AIGB-Pearl,通过 Lipschitz 连续性与 KL 散度双重约束构建"生成-评估-优化"闭环,成果被 ICLR 2026 接收为 Oral。
有Reddit用户搭建了一个《魔兽世界》3.3.5版本私服,接入DeepSeek API后,1800个AI玩家能在聊天频道像真人一样聊天、组队和闲逛。他基于自带Playerbots机器人和本地大模型聊天接口的现成Repack安装包,用Python脚本把聊天请求转发到DeepSeek云端API,此前450个Bot版本每月API费用不到10欧元。
量子位面向 AI 产业、AI 财经、AI 产品三大方向招聘编辑、主笔、主编,全职工作地点为北京中关村,社招与校招(含实习转正)均开放。岗位要求分别覆盖芯片、AI Infra、云计算,创投与财报,以及 AI 应用和硬件终端落地。简历投至 zhaopin@qbitai.com,需附科技行业代表作品。
英伟达、CMU 和 Berkeley 联合推出具身智能 Autoresearch 框架 ENPIRE,让 8 个 Coding Agent 各自控制一台双臂机器人,自行读论文、改算法、训练策略、部署实验并分析结果。
中科大等团队开源 Crayotter(Traceable Multi-Agent Workflows for Long-Form Video Editing),将长视频剪辑状态外化为检索覆盖率报告、时间轴计划、转场计划等可检查工件,使失败可定位到具体片段并局部修复。
中国初创团队Catnip发布流式音视频模型MaineCoon,参数量22B,单张H100可跑出47.5 FPS,同赛道速度居首。模型支持边生成边播放、音画同步,连续生成时长可达30分钟以上,每秒成本控制在0.001美元以内。Catnip同步发布技术报告和社交短视频基准SocialVideo Bench,并限量开放200个内测邀请码。
Meta CTO Andrew Bosworth在内部备忘录中承认,公司这轮AI重组的愿景沟通与员工支持做得糟糕透顶,并称重组动摇了员工对自身专长、成长和工作影响力的三重信任。
陶哲轩12年前预言数学家将用计算机可理解的形式化语言取代LaTeX撰写论文,如今他通过Lean4和AI协作将其变为现实。他发起的Equational Theories项目针对约2200万个代数等式,依靠AI写证明、Lean自动核验、全球志愿者协作,48小时内完成大规模筛选,前9天进度达99.866%,第57天主项目基本完工,仅剩162个蕴含关系待收尾。
Google DeepMind 的诺奖得主、AlphaFold 之父 John Jumper 宣布离职并加入 Anthropic,两天前 Transformer 核心作者 Noam Shazeer 也离开 DeepMind 加入 OpenAI。
推荐理由:48小时内DeepMind连失两位核心人物,可见Anthropic与OpenAI在生命科学和AI编程上的吸引力。
香港大学李弘扬团队联合华为、上海创智学院及清华大学李升波教授团队发表论文 World Engine,提出面向端到端自动驾驶的后训练框架。该框架由 SimEngine、Behaviour World Model 和 Reinforcement Post-training 三部分组成,把真实驾驶日志中的长尾失败重建为可闭环交互的仿真环境,再用带行为约束的强化学习后训练策略。
演语科技(Evoken)完成近3亿美元B+轮融资,投后估值超过20亿美元,由Granite Asia、腾讯、顺为资本联合领投,高榕资本、蚂蚁集团、红杉中国等现有股东继续加码。
银河通用机器人发布 AstraBrain-WBC 0.5,定位面向人形机器人全身实时运控的小脑基础模型,基于约2万小时、约20亿帧人类动作数据训练,参数规模8040万。
OpenAI 与 Molecule.one 联合发布新成果,GPT-5.4 在近乎自主条件下改进了药物合成中常用的 Chan–Lam 偶联反应。
中科大等团队开源 Crayotter(Traceable Multi-Agent Workflows for Long-Form Video Editing),将长视频剪辑重构为基于工件溯源的智能体轨迹问题,通过覆盖率感知的多模态素材检索、环境驱动的反射机制和轨迹级 RLVR(GRPO 优化)实现局部修复而非整体重生成。
百川智能推出医疗大模型 Baichuan-M4,HealthBench 综合得分提升至 68.6,Hard 任务 49.7,幻觉率降至 3.3%。在 HealthBench Professional 基础推理评测中得分 55.1,高于 GPT-5.5 的 51.8;长上下文临床记忆得分 86.9,较 M3 提升 21.1 分。该模型已落地 C 端产品百小医,支持多轮追问与全病程记忆。
Midjourney 官宣推出医疗硬件项目 Midjourney Medical,其全身超声波扫描仪 Midjourney Scanner 由约 50 万个微型换能器单元组成,目标在 60 秒内完成扫描,官方称比现有 MRI 快近 100 倍,可生成亚毫米级精度的全身 3D 地图。
何恺明团队发布文生图新论文 MiniT2I,基于 MM-JiT 架构直接在像素空间做扩散生成,仅用 258M 参数。该方法删去 VAE 和 AdaLN,单次前向计算开销降至 265 GFLOPs,比潜空间模型减少约 80%,训练只需 8 张 H100 约 3 天。B/16 版本总参数量不到 600M,在 GenEval 上达到 0.87、DPG-Bench 达到 84.2。
美图在影像节上一口气发布 Picchi、Artflo、MVLAND、MeituHub 等 8 款 AI 产品,主打 Agent Teams 协作执行,让用户从操作工具转向表达需求、直接获得交付成果。
Transformer 核心作者 Noam Shazeer 宣布加入 OpenAI,这是他第二次离开谷歌。2024 年谷歌曾以约 27 亿美元的技术许可协议把他从 Character.AI 请回,他回归后与 Jeff Dean、Oriol Vinyals 共同担任 Gemini 项目的技术负责人。
16人创业公司码上飞为华为HDC 2026展示的鸿蒙小艺Claw提供后端技术服务,其AipexBase是国内首个开源AI原生后端即服务平台,小艺Claw后端即基于该平台构建。码上飞成立于2023年,注册用户接近百万,ARR超千万元,月环比增长约25%,团队由腾讯系工程老兵与02后AI原生一代混编组成。
泄露的 OpenAI 财务文件显示,2025 年全年收入 130.7 亿美元、支出 340 亿美元、净亏损 385 亿美元,2026 年第一季度收入 57 亿美元、烧掉 37 亿美元。
推荐理由:泄露财报呈现 OpenAI 收入与亏损同步放大的资金结构,并与 Anthropic 的财务走向形成对照。
是石科技在2026国产异构算力创新发展论坛上提出"国产Token优化工厂"定位,不做芯片也不做大模型,专攻从异构算力到标准化Token生产能力的工程化转化。创始人闫博文称国产算力瓶颈不在芯片本身,而在适配难、调优贵、生态散,部分已建成智算中心国产算力使用率不足50%。公司已服务200多家重点客户,近日正式启动B轮融资,此前一年内已完成三轮融资。
九章云极在 2026 全球智算科技峰会暨战略发布会上推出"AI 工厂"战略,由训练工厂和 Token 工厂两部分组成,目标算力规模 10 万 P、日均产能 10 万亿 Token。
腾讯混元庞天宇团队开源 UniRL,一个面向统一多模态生成的分布式 RL 后训练框架,将扩散模型、自回归模型与生成理解统一模型的强化学习训练纳入同一套流程。
星海图在6月16日首届全球开发者大会(Galaxea WDC 2026)上发布新一代VLA基础模型G0.5并宣布开源,联合北京亦庄发起数据公司亦数智能,提出100万小时超高质量真实数据计划。
浪潮信息董事长彭震在人工智能+生态大会(AIEC2026)上提出,AI转型最大的门槛不是技术而是人,并抛出描述未来企业基本构成单元的新词 Humagent(Human+Agent)。
量子位Robo团队面向汽车及机器人(具身智能)方向招聘编辑与视频主创,编辑岗基础月薪10K-20K,另加项目奖金与商务提成。编辑需追踪大厂战略、独角兽融资等一手内幕并撰写深度产业长文;视频岗要求3年以上经验、持C1/C2驾照,年均出差占比约40%。简历投递至zhaopin@qbitai.com。
讯飞医疗发布星火医疗大模型V3.5,在IDC《中国医疗大模型技术评估,2026》中综合实力行业第一,15项核心指标中12项领跑,MedBench智能体评测98.9分登顶,多项临床任务综合能力超越GPT-5.5最高推理档。该模型基于昇腾910B全国产算力训练,推理吞吐量提升4.5倍,在三甲医院真实应用中病历生成采纳率达91%,病历书写时间缩短52%。
知乎答主toyama nao在2025年累计测试模型126个、耗时超400小时,持续发布模型排行榜与评测结果。设计师德里克文以Agent协同探索人机共创,57岁程序员Jeff Tao陶建辉则扎根基础软件与工业场景,创业TDengine做时序数据库。知乎创始人、CEO周源认为,用户真正需要的是认知提升、经验分享与真实连接,而非AI本身。
记者 Ed Zitron 获得的 OpenAI 审计报告显示,2025 年收入 130.7 亿美元、支出 340 亿美元、亏损 385 亿美元,亏损约为 2024 年的 8 倍;2026 年 Q1 收入 57 亿美元、烧掉 37 亿美元,现金消耗超过当季收入一半。
推荐理由:泄露财报给出 OpenAI 的成本结构与盈亏时间表,并与 Anthropic 同期数据形成对照。
蚂蚁集团 CodeFuse 团队在 ACL 2026 主会论文中提出 EGSS,用工具熵指标识别高不确定性决策点、只在关键步骤展开多候选探索,并以跨轨迹测试整合机制用执行结果替代主观评分来筛选补丁。
智谱开源 GLM-5.2,在 Arena 编程榜单上取得全球第二、开源第一,并在 Design Arena 品味评测中位列全球第一。该模型支持 1M 上下文,量子位用 Appsmith、OpenWebUI 等项目实测了整库架构梳理、跨文件追 Bug 和新增导出功能等任务,其中新增功能一例跑通 38 个后端测试。
斯坦福丛乐与普林斯顿王梦迪团队在 arXiv 发布预印本《Science Earth: Towards A Planet-Scale Operating System for AI-Native Scientific Discovery》,推出面向 AI 原生科学发现的行星级操作系统,赵哲为第一作者。
SpaceX 于 6 月 16 日签署合并协议,以约 600 亿美元全股票方式收购 AI 编程工具 Cursor 的母公司 Anysphere,Cursor 作为存续实体成为 SpaceX 全资子公司。
推荐理由:原文给出全股票对价、终止费与算力合作的披露细节,读者可据此看清这次收购在马斯克算力布局中的位置。
北航、360 AI安全实验室、牛津大学、北京大学等机构联合提出RoboSafe框架,为具身智能体提供运行时安全护栏,该研究获ICLR 2026 ESR研讨会杰出论文奖。RoboSafe通过前向预测推理和后向反思推理识别情境与时序风险,在AI2-THOR仿真中把危险执行率压低到4.78%,相比现有防护方法整体降低36.8%的危险执行率,并在真实机械臂上成功阻止危险动作。
Current Robotics 发布全身灵巧操作模型 Curr-0,通过 Single Policy 在同一模型中耦合移动、全身姿态协调与手部精细操作,实现全程自主执行。该模型基于 21,000 小时真实人类行为数据训练,其中包含 2,800 小时全身示教数据,数据来自其自研全身外骨骼采集系统 HumanEx。Demo 中机器人完成了撕茶包、点香、盖章、捡起揉皱纸团及抱玩具穿过门口等任务。
大晓机器人宣布完成天使+轮融资,达晨财智、深创投、上海科创基金、沐曦股份等多家机构参与,老股东商汤国香资本持续增资,算上去年底的天使轮,半年累计融资金额已达数亿美元。
燧原科技科创板首发过会,本次拟募资60亿元用于产品研发,有望成为A股第三家上市的国产AI芯片厂商。腾讯为其第一大股东,持股20.26%,也是最大客户,2025年对腾讯销售额占总收入83.79%。公司营收从2023年的3.0亿元增至2025年的9.9亿元,复合增长率81.32%,亏损收窄至2025年的11.64亿元,预计2026年或可实现基本盈亏平衡。