清华团队开源 OpenRath,以 Session 为核心的多智能体运行时
清华大学、中山大学和香港中文大学的 Rath Team 开源了 OpenRath,一个把 Session 当作一等公民的多智能体、多会话运行时,已在 PyPI 发布到 v1.2.1,采用 BSD-3-Clause 协议。
微信公众号
清华大学、中山大学和香港中文大学的 Rath Team 开源了 OpenRath,一个把 Session 当作一等公民的多智能体、多会话运行时,已在 PyPI 发布到 v1.2.1,采用 BSD-3-Clause 协议。
华为在 HDC2026 推出基于 Agentic 新架构的鸿蒙小艺,将其从问答助手升级为可调度系统能力的系统级智能体。官方称 2100 多项系统能力可被小艺调用,200 多项系统级数据接入上下文,500 多个生态 Skills 接入小艺 Claw 的 Skills 市场。
量子位与Lumina社区将于本周三晚19点在北京海淀举办闭门交流,邀请刚从ICRA与CVPR归来的技术专家分享一线观察。嘉宾包括PNDbotics联合创始人兼CTO崔昊天、极佳视界算法合伙人王啸峰,以及清华大学MotuBrain Project Lead谭恒楷,聚焦具身智能、VLA与世界模型等方向,并同步开启线上直播。
量子位Robo团队面向机器人与智能汽车方向招聘产业记者/科技作者和视频编导/视觉主创两个岗位,基础月薪10K-20K,另有项目奖金与商务提成。产业记者需挖掘大厂战略调整、大牛离职创业、独角兽融资等一手内幕并撰写深度产业长文;视频编导要求3年以上视频制作经验、持有C1/C2驾照,年均出差时长占比约40%。简历投递至zhaopin@qbitai.com。
英伟达完成250亿美元债券融资,认购订单高达850亿美元,认购倍数超过三倍,发行规模也从最初计划的200亿美元上调。这批分七个档次、期限2年到30年的高级无抵押票据中,30年期债券定价利差从约90个基点收窄至65个基点,标普给出AA级信用评级。原文提到,截至2026年5月底全球与AI相关的债券发行规模已达2360亿美元,较去年同期增长357%。
推荐理由:原文以认购倍数和全球AI相关债券发行规模两组数据,呈现算力基建融资潮的体量与节奏。
TRAE 举办 AI 创造力大赛《世界很大,放手去造》,面向全社会开放报名,无身份和能力限制,参赛者可用 TRAE Work 和 TRAE IDE 快速生成 demo。大赛设生活娱乐、学习工作、社会服务、硬件交互 4 个通用赛道及 1 个附加赛题,决赛现金池 100 万+,报名即送 TRAE 速通 Pro 月卡。胡彦斌、罗永浩、王兴兴、楼天城、影视飓风 Tim 担任领造官与评审。
前阿里千问负责人林俊旸创办的AI实验室完成首轮融资,总额数亿美元,投后估值约20亿美元(约135亿元人民币)。高榕创投与红杉中国联合领投各出资1亿美元,腾讯跟投2000万美元。创业方向聚焦世界模型和具身大脑。
量子位与Lumina社区将于本周三晚19点在北京海淀举办线下沙龙,邀请刚从ICRA与CVPR归来的技术专家分享一线观察。嘉宾包括PNDbotics联合创始人兼CTO崔昊天、极佳视界算法合伙人王啸峰,以及清华大学MotuBrain Project Lead谭恒楷,聚焦具身智能、VLA与世界模型等方向,并同步开启线上直播。
巴西里约一家IT公司开源的 Rio 3.5 被上海创智学院 Nex 团队指控为套壳 Nex 与 Qwen 的缝合模型,Rio 团队已下架涉事模型并在 HuggingFace 页面致歉。
月之暗面放出 Kimi K2.7 Code,这是 Kimi K2 系列首款专攻代码领域的专项模型,代码与 Agent 能力进阶,平均 Token 消耗减少 30%。
Noiz AI 联合香港科技大学、清华大学等机构推出开源音频生成大模型 AudioX-Turbo,通过分布匹配蒸馏和对抗蒸馏把扩散生成从50到200步压缩到4步,前向次数下降约25倍。在单张 RTX 4090 上生成10秒音频仅需0.24秒,RTF 为0.02,并配套约920万规模的强指令数据集 IF-caps-Pro,支持文本、视频、图像输入。训练代码、推理代码及模型权重已全部开源。
TerminalTraj 从真实 GitHub 仓库自动构建 Docker 化可执行环境并生成与环境强绑定的终端任务,已构建 32K Docker 镜像和 50733 条经可执行代码验证的终端轨迹,该工作被 ICML 2026 接收为 Spotlight。
AIVA团队推出名为AIVA的硅基生命体Agent,其首具身体是汽车,首款量产车型AIVA ME7计划2026年内亮相,定位20万元以上主流市场。AIVA被设计为具备长记忆、跨场景推理和主动执行能力的Agent,可在车机、手机、手表间流转,并搭载负责记忆存储、意图理解与车控指令下发的Agent OS。该方案由赛力斯提供制造与供应链、火山引擎提供基础模型与算力,AIVA自建中间层。
AI 网关 OrcaRouter 上线可编程路由策略 Routing DSL,通过多模型并行扇出加仲裁,让 Opus 4.8 与 GPT-5.5 组队得分约 67.5%,反超 Fable 5 单跑的约 65.5%。
清华系公司光象科技发布工业级自进化具身智能机器人 Phi-Bot X1,在 2026 ATC 展会蔚来汽车焊接上下料场景中完成连续 3 天、累计 21.5 小时作业,零失误、零中断,成功率 100%。
改装版宇树G1「Pemba」于6月5日登顶厄瓜多尔钦博拉索火山,海拔约6200米。项目主导者Pablo称这是首个登顶2万英尺的人形机器人,16小时冲顶中机器人仅在坡度小于30°路段自主行走,更陡路段由探险队员抬上。团队下一步计划挑战夏威夷茂纳凯亚与珠峰,珠峰测试因尼泊尔尚无相关法律框架,暂定2026年10月并可能推迟到2027年4月。
复旦大学邱锡鹏团队(OpenMOSS)提出 Thinking with Video 推理新范式,让视频生成模型以视频帧为统一媒介进行多模态推理,该工作被 CVPR 2026 收录。
Fable 5 发布后,多位开发者表示过去拆分步骤的 Agent 工作流和 SOP 开始失效,一句话交代目标模型就能跑完任务。Simon Willison 记录 Fable 5 为修 2 行 CSS bug 自行造出浏览器自动化工具链,Ethan Mollick 则让它检索 2200 多条航班数据生成可交互等时线地图,并产出开源工具 Concord。
量子位将于6月17日(周三)19:00-21:00在北京海淀举办「ICRA / CVPR AFTER HOURS」线下交流活动,邀请PNDbotics联合创始人兼CTO崔昊天、极佳视界算法合伙人王啸峰等企业技术专家现场分享。活动面向具身智能与机器人从业者及研究者,围绕ICRA、CVPR双顶会后的论文方向、被低估领域及技术判断更新展开小范围交流。
OpenRouter 的 Fusion 多模型融合方案在 DRACO 深度研究基准上的测试显示,Kimi K2.6、DeepSeek V4 Pro、Gemini 3 Flash 组合综合得分 64.7%,接近 Claude Fable 5 的 65.3%,整体综合调用成本降幅接近 80%。
vivo BlueImage Lab 联合浙江大学等发布 VeraRetouch,用 0.6B 视觉语言模型作"修图大脑"、全可微分 Retouch Renderer 作执行器,支持 Auto-Retouch、Style-Retouch、Param-Retouch 三类任务。
清华大学电子工程系李勇教授团队联合北京师范大学在 Nature Machine Intelligence 发表论文《Learning the coupled dynamics of global climate modes》,提出全球气候模态统一预测模型 UniCM。
华为云在 INSPIRE 创想者大会上发布 AICS 灵衢智算集群、AMS Agentic 记忆存储、CCE Volcano Next 和 AgentSphere 四款 Agentic 基础设施,分别解决算力、记忆、调度与安全问题。
百度百舸团队联合复旦大学提出 LU-KV 框架,将注意力头级 KV Cache 预算分配建模为长程边际效用的全局组合优化问题,相关成果被 ICML 2026 录用。
openJiuwen 社区正式开源 Jiuwen Symbiosis,一个专为 physical AI 打造的共生架构,让 Agent 从数字世界走向物理世界。
Sapient Intelligence发布HRM-Text,这是一个约1B参数、训练成本约1500美元的从零预训练模型,在MATH上得分56.2、GSM8K上84.5、ARC-Challenge上81.9。
华为GTS AI算法部联合香港中文大学(深圳)、香港大学发布SpaceMind,在仅用RGB输入、不依赖深度图与点云的条件下,于李飞飞团队的空间智能榜单VSI-Bench上以70.6%综合得分刷新纪录,接近人类平均79%的水平,该工作已被CVPR 2026接收。
香港科技大学团队提出 Robust-U1,让多模态大模型用自身生成先验先复原损坏像素、再结合复原图与原始脏图推理作答,论文已被 ICML 2026 接收。该方法以统一模型 BAGEL 为底座,经配对数据训练和强化学习调优,在 R-Bench 上综合得分 0.74,高于最优外接修复方案 0.55。
香港城市大学曾晓成与中国石油大学(华东)钟杰团队用无监督深度学习框架分析7400多万个水分子结构,证明常压水中存在类高密度A与类低密度B两种「暗」组份,成果发表于《Nature Physics》。AI算出的A组份占比与系统总体积呈R²接近0.99的线性关系,并绘出含3个鞍点(SP-1、SP-2、SP-3)的环状转换路径。
千问推出足球预测AI助手,在2026世界杯揭幕战前预测墨西哥2:0南非、韩国2:1捷克,两场比分全部命中,还提前点出南非可能因动作过大陷入少打一人,结果该场出现三张红牌。千问还押中希门尼斯进球,并在韩国对捷克1:1僵持时坚持不改预测,最终韩国第80分钟绝杀。
香港中文大学(深圳)、香港科技大学(广州)等团队提出MASPOB,在固定工作流拓扑下联合优化多智能体系统中各Agent的Prompt,该工作已被ICML 2026接收为Spotlight。
智源研究院在2026智源大会上发布悟界·Physis-v0.1,称其为全球首个通用世界基座模型,能让AI像物理引擎一样预测动作在真实世界产生的后果。同场还发布具身大脑悟界·RoboBrain Orca、多模态神经科学大模型悟界·Brainμ1.0与药物发现模型悟界·OpenComplex2.5,以及面向心脏磁共振、科学发现、个人助手和有害蛋白风险发现四款Agent。
清华大学与 GigaAI 联合提出 RhymeFlow,一个完全免训练的视频生成加速框架,通过帧间异步调度让关键帧走完整去噪流程、非关键帧差异化跳步,在 Wan 2.1、CogVideoX 等主流 DiT 模型上推理提速 1.5×–1.8×,与现有方法叠加可达 1.93×。82 人双盲用户研究中 62.5% 的用户无法区分加速结果与原始模型。该框架已开源。
估值9650亿美元的Anthropic中,创始人Dario Amodei只有一名直属下属——幕僚长Avital Balwit,其余高管全部向联合创始人兼总裁Daniela Amodei汇报。
UC伯克利团队发布智能体基准Agents' Last Exam(ALE),让AI Agent在Siemens NX、Unreal Engine、After Effects等真实软件中完成任务。
田渊栋创立的 Recursive 公布首个研究成果,其自动化 AI 研究系统在 NVIDIA SOL-ExecBench、NanoGPT Speedrun 和 NanoChat Autoresearch 三个 benchmark 上取得 SOTA。
千问在 app 内上线名为「美加墨」的足球预测 AI 助手,包含「比赛日历」和「预测投票」两大板块,用户可参与比分预测赢积分。该助手从比赛定性、核心论据、进球剧本、场外因素四方面给出预测理由,并推演了梅西与C罗本届世界杯能否相遇。用户总积分每达一定额度,千问将为乡村及基础薄弱地区学校捐建或修整足球场,目标至少50所。
陶哲轩主导的 First Proof 项目公布第二批评测结果,10 道前沿研究级数学新题中有 7 道获得达到学术发表标准的 AI 解答,其中 Problem 5 随机偏微分方程题 AI 用与人类完全不同的方法推出更强结论。
开发者发现把 Claude Fable 5 的努力程度调到最低 low 档后,token 消耗更少,且在 SWE-bench Pro 上拿到 75.0 分,仍高于 Opus 4.8 开到 xhigh 档的 68.6。
谷歌发布并开源扩散文本模型 DiffusionGemma,采用一次铺开256个token整块去噪的方式,在单块H100上跑出1000+ tokens/s,比同规格自回归模型快约4倍。