苏度 WAIC 首秀:从1到10+技能跃迁,探索通用机器人 Scaling 路径
苏度科技在 WAIC 2026 首次国内公开参展,展示十余项机器人技能、自研 22 自由度直驱灵巧手,以及与宁德时代合作的电池装配方案,抓取成功率达 99.5% 以上。其路线以仿真训练加真机辅助的虚实融合为主,据称每天可生成百万级数据,目标是 2027 年百台级交付、2028 年进入千台级规模。
微信公众号
苏度科技在 WAIC 2026 首次国内公开参展,展示十余项机器人技能、自研 22 自由度直驱灵巧手,以及与宁德时代合作的电池装配方案,抓取成功率达 99.5% 以上。其路线以仿真训练加真机辅助的虚实融合为主,据称每天可生成百万级数据,目标是 2027 年百台级交付、2028 年进入千台级规模。
在 7 月 17 日开幕的 WAIC 2026 上,走访 100 多个机器人展台可见具身智能已从翻跟头、打拳等表演转向工业产线、家庭客厅、商超零售和公共服务等真实场景。
跨维智能在 WAIC 2026 展示自研仿真引擎 DexVerse,称其是全球唯一支持同场景多物理场耦合的具身智能仿真引擎,可同时耦合刚体、软体、布料、流体 4 种材质。
在 WAIC 2026 演讲中,图灵奖得主 Richard Sutton 提出,基础模型本质上是人类已达成共识知识的容器,而非所有知识的容器,其能力上限也因此受限于人类已有数据。他认为「苦涩的教训」对今天的大语言模型是「是,也不是」,若历史规律再次出现,未来取代基础模型的可能是一种能自主创造知识的新方法。在他看来,更值得追求的目标是让基础模型成为准确、可靠、人人可用的「超级百科全书」。
GAIR Live 032 圆桌邀请模量科技高立波、超维传感李炎辉、千觉机器人赵浩南,讨论具身智能从视觉主导转向视触融合。赵浩南称没有触觉的灵巧手只是"高级夹具",视觉在最后一厘米存在遮挡、状态感知缺失和高频反馈迟滞三大局限。高立波透露模量科技已实现每平方厘米近 400 个集成单元,正向 1000 个单元冲刺。
南洋理工大学李搏扬团队用数学分析找出 MTS(Meta-learning for Training-data Selection)失效的两大根源:选择网络梯度信噪比(GSNR)比主网络低约一个数量级,且输入特征不足以判断数据质量。
阶跃星辰与千里科技在WAIC 2026联合发布汽车超级智能体,搭载阶跃最新Agentic模型Step 3.7 Flash,总参数196B、推理激活仅11B,400TPS响应,编程能力达Claude Opus 4.6的97%,任务成本仅为其九分之一。该端侧模型可在车机本地运行,弱网环境下仍实时在线。千里科技智驾系统已覆盖50多万辆车,辅助驾驶激活率达92%。
上海交通大学牛力实验室提出 ICRDrag,一个基于 DiT 架构的上下文区域拖拽模型,用成对掩码实现高精度图像局部编辑,论文入选 ECCV 2026。该模型支持最多 5 对源/目标区域协同与锚点锁定,并基于百万级视频数据集 OpenVid 构建了 28.7 万组配对样本的 PRD 数据集及 1000 组样本的 PRDBench 评测基准。
AI科技评论以开源框架 OpenHands 为执行环境、经 OpenRouter 接入 Hy3、GLM-5.2、DeepSeek-V4-Pro 三个裸模型,跑同一组三道题并由 Claude Opus 4.8 盲评。
OpenAI Codex 负责人 Tibo 在 X 上发起活动,用户发推文谈喜欢 GPT-5.6 Sol 或从 Claude 换到 Codex,审核通过即获 100 美元积分,限前 1 万人。活动条款写明提交即永久授权 OpenAI 在付费广告中使用推文和 X 账号名。文章还提到 Codex 周活跃用户从今年 1 月不到 100 万涨到活动后的 900 万。
EgoScale 创始人袁日正称,国内真正能规模化交付 Ego 数据、被头部客户验收的团队不超过 5 家,EgoScale 交付量稳居前三。其自研双目相机帽子采集设备,月周转 1500 名采集员、全职团队不到 20 人,有效采集率达 80%,上个月完成 1.0 自动化,本月中将完成 2.0。
中山大学与 X-Era AI Lab 团队发现,VLA 模型在新视角、光照、纹理和传感噪声下的脆弱性主要来自空间建模错位,而非物理推理能力缺失。其 one-shot 鲁棒适应框架 FTM 仅用约 4K 参数,就把 LIBERO 新视角任务成功率从 48.5% 提升到 87.1%;FLA 用约 4.7M 参数达到 90.8%,参数量比 LoRA 基线减少约 99 倍。
AI科技评论独家获悉,智谱以数亿元人民币收购 AI Infra 公司中科加禾,试图补齐模型底层工程能力短板。中科加禾聚焦编译技术,技术源头为中科院计算所编译实验室,其团队曾参与龙芯、神威、寒武纪、华为昇腾等国产芯片编译器研发,其 SigInfer 推理引擎宣称可将大模型推理时延最高降低 74 倍、吞吐率最高提升 3 倍、能效比提升 1.46 倍。
7 月 15 日,匿名模型 Kivine 突然上线 LMArena,数小时内引发全球 AI 社区关注,测试者怀疑它就是月之暗面尚未发布的 Kimi K3。用户反馈 Kivine 具备 1M context 长上下文能力,输出质量接近 Fable level,但一次完整生成需等待约 35 分钟。
PPIO派欧云将在WAIC正式发布专为AI智能体打造的Agentic Cloud,其推理加速引擎性能提升可达10倍,Prompt Cache技术使Token成本最高省80%,2026年6月日均Token调用量超1.2万亿、同比增长超8倍。张江MetAI Hub・AI应用商店同步亮相,MetAI Box+将于7月16日全球首发、7月17日登陆WAIC双会场。
工信部联合国务院国资委启动《2026年度人形机器人与具身智能实景实训专项行动》,明确生产制造、检测分析、仓储物流、医疗康养等九大重点场景,上海承接落地。2026全球开发者先锋大会暨国际具身智能技能大赛将于10月23—25日在上海张江科学会堂举行,设百万奖金池与千万投资额,晶泰科技、长电科技、安波福、复兴岛等场景方已开放真实产线赛题。
RSS 2026 将时间检验奖颁给 2014 年论文《A Novel Type of Compliant Underactuated Robotic Hand for Dexterous Grasping》,其软体气动机器人手 RBO Hand 无需传感器和复杂力控算法,抓鸡蛋、豆腐与不规则零件时控制指令完全相同,靠硬件顺应性完成抓握姿态计算。
南加州大学 PSI Lab 在 RSS 2026 展示人形机器人基础模型 Ψ₀,用约 829 小时 EgoDex 第一视角人类视频预训练,仅需约 30 小时真机遥操作数据完成控制学习,在 8 个真实世界长程任务中成功率相比公开基线提升超 40%。
ICML 2026 最后一天的 workshop "AI Scientists —— Tools, Co-authors, or Founders?" 上,Meta、Anthropic、LG AI、UCSF 和首尔大学五位嘉宾围绕"如何定义 AI scientist"展开辩论。
爱诗科技的 PixVerse Game 于今日正式在海外上线,成为市场上首个基于实时视频的游戏引擎,用 PixVerse R1 实时世界模型持续生成的画面替代传统游戏的渲染工作。
OpenAI 核心产品负责人 Thibault Sottiaux 在推特宣布,Codex 和 ChatGPT Work 活跃用户达到 800 万,将再次为所有用户重置使用额度,并继续不设 5 小时速率限制。
Google 在 6 月 30 日面向开发者发布 Nano Banana 2 Lite 与 Omni Flash,Lite 是 Nano Banana 家族中速度最快、成本最低的一款,4 秒生成一张 1K(1024×1024)图像,单张 0.034 美元。
普林斯顿大学教授 Arvind Narayanan 在 ICML 2026 的主旨演讲中提出,AI 的能力在飙升而可靠性几乎没动,因此当前它更像协作工具而非替代工具。
中科煜坤两篇论文被 ECCV 2026 录用,分别提出 3D 空间推理模型 SpaR3D-MoE 与 4D 动态重建方法 Minute4D。SpaR3D-MoE 首次将 MoE 引入 3D 空间推理,仅用 32 个稀疏 RGB 帧即在 VSI-Bench 取得 63.5 平均分,超最强基线 Qwen3VL-8B 7.8 个绝对点。
Google 研究员 Ali Behrouz 团队提出《Language Models Need Sleep》,主张大模型应在「清醒」与「睡眠」间切换:清醒时接收信息,睡眠时通过 Knowledge Seeding 整理记忆,再借 Dreaming 生成合成数据继续训练自己。该思路针对持续学习中的灾难性遗忘,让模型在保持稳定的同时吸收新知识。
香港大学助理教授李弘扬获 RSS 2026 青年成就奖,成为该奖设立22年来首位获奖的国人学者,今年全球仅4人获奖。他因 BEVFormer、UniAD 及与智元合作的 AgiBot World 百万真机数据集等工作获认可,现提出全身智能(WBI)路线,主张统一感知、决策、运动控制与灵巧操作,并计划将重心转向创业,打造具身大脑。
香港大学助理教授李弘扬获 RSS 2026 年度“青年成就奖”,是该奖项设立20年来唯一国人获奖者,他在演讲中提出从全身控制(WBC)向全身智能(WBI)的范式转移。其团队用超10万小时数据、3000多个环境和700多个角色进行大规模预训练,并提出实现 WBI 约需 10B 参数模型、100K 小时人类数据和 500 到 1000 张 H200 级 GPU。
7月13日,强化学习之父、2024年图灵奖得主 Richard Sutton 与前博士生 Khurram Javed 离开 John Carmack 创立的 Keen Technologies,成立新公司 Oak Lab。
RSS 2026 在悉尼开幕,首日两场 Oral 报告共 18 篇论文中 17 篇有华人学者参与,占比 94%。其中 LingBot-VA 作为全球首个开源自回归视频-动作世界模型,在 RoboTwin 2.0 的 50 个双臂操作任务中成功率达 92.0%。
RSS 2026在悉尼开幕,主会仅接收约160篇论文,Manipulation 1环节的9篇代表作显示机器人操作正从「数据饥渴」转向「样本高效」。BiDemoSyn仅需一段真实示范视频即可合成数千条双臂训练数据,SID在仅两次演示下于六个真实任务中保持约90%成功率,DexImit则直接从单目人类视频中提取双臂灵巧操作知识。
上海交通大学团队的Holi-Spatial管线入选ICML 2026 Oral,它通过几何优化、图像级感知与场景级精炼三阶段,把2D网页视频转成3D空间标注数据,无需激光雷达和人工标注。
香港科技大学(广州)HCLab 实验室陈翔宇率队夺得 ICRA WBCD 柔性操作赛道维也纳赛区冠军,连续两届在该赛事双臂操作方向夺冠。本届赛事设维也纳、硅谷、上海三赛区共四个赛道,150 多支队伍报名、约 40 支进入决赛,官方与赞助商提前放出 UMI 数据供赛前预训练。
爱诗科技宣布完成整体 C 轮融资,累计 29.8 亿元人民币,其中 C+ 轮由阿里巴巴领投,Lollapalooza Capital、常春藤资本、钟鼎资本、韩国未来资产等十余家机构参与。
蚂蚁集团开源 SingGuard 与 SingGuard-NSFA 两套安全框架,分别针对模型内容安全和智能体操作安全。
Meta 收购 AI 安全创业团队 Virtue AI,创始人李博及其团队进入 Meta Superintelligence Labs。双方此前已从战略合作切入,Meta 曾是 Virtue AI 的客户,看重其自动化红队、运行时防护与 Agent 安全测试等能力。李博判断,Agent 时代 AI 安全需从模型安全走向覆盖开发、测试、部署、运行全过程的系统安全与 Agent 安全。
中国科学技术大学联合北京人形机器人创新中心推出 Labimus,一个面向精准化学实验室人形机器人灵巧操控的仿真与评测平台。它用 Real-to-Sim 重建 30 余件实验器材,拆解出六个原子操作和七步固体称量工作流,并提出 Task Success ≠ Scientific Success 的三级评测层级。
第22届机器人学:科学与系统大会(RSS 2026)将于7月13日–17日在澳大利亚悉尼ICC举行,VLA Models、Humanoids、World Models 今年全部单独成立 Session。
哈尔滨工业大学(深圳)计算机学院长聘教授杨朔创立破晓智能(PHANES AI),聚焦人类数据、触觉感知与世界模型研究,目标是让机器人从学习人类操作经验走向人形机器人全身移动灵巧操作。
ICML 2026 共接收 6352 篇论文,其中 Spotlight 论文 536 篇(占 2.2%)、Oral 论文 168 篇(占 0.7%)。
ICML 2026 接收的 6341 篇论文中有 49 篇属于世界模型分类,占比不到 1%,但研究范式正从 LAWM 向 WAM 倾斜,WAM 论文比重强劲反弹并占据半壁江山,二者融合的论文稳步增加。LAWM 正退居幕后成为具身智能的认知基座,WAM 则向真实物理控制发起总攻,当前最具潜力的范式是 LAWM 预训练加 WAM 微调对齐。