走访 ICRA 2026 30+中国企业,具身智能产业三大趋势浮现
雷峰网·AI科技评论在 ICRA 2026 现场走访 30 多个中国具身智能展位后,总结出三大趋势:全栈闭环成为标配、数据采集被推到台前、灵巧手加速向人手看齐。千寻智能、零次方、魔法原子等已自建数据采集工厂,它石智航首次展示 21 自由度 1:1 人手比例 DexHand 灵巧手,舞肌科技 Wuji Hand 2 达 20 个主动自由度。
微信公众号
雷峰网·AI科技评论在 ICRA 2026 现场走访 30 多个中国具身智能展位后,总结出三大趋势:全栈闭环成为标配、数据采集被推到台前、灵巧手加速向人手看齐。千寻智能、零次方、魔法原子等已自建数据采集工厂,它石智航首次展示 21 自由度 1:1 人手比例 DexHand 灵巧手,舞肌科技 Wuji Hand 2 达 20 个主动自由度。
复旦大学可信具身智能研究院联合上海交通大学、香港大学 OpenDriveLab 等机构提出 GuidedVLA,在 VLA 动作解码器中指定注意力头分别关注目标、步骤和空间三类因素,该工作已被 Robotics: Science and Systems(RSS)2026 接收,并开放论文、代码、模型权重和数据集。
CVPR 2026 几何智能研究呈现从静态形状重建走向空间理解与交互的趋势。牛津、剑桥等提出 PARTICULATE,可从静态 3D mesh 一次前向推理预测关节结构;苹果与多伦多大学提出 Velox,将时空点云压缩为 dynamic tokens,压缩超 30 倍。首尔大学 HeSS 优化 VGGT 注意力稀疏分配,清华等 GeoCodeBench 显示 GPT-5 通过率仅 36.6%。
CVPR 2026 正会在丹佛开幕,共收到 16,092 篇有效投稿,较 CVPR 2025 增长 24%,最终录用 4,071 篇,录取率约 25.3%。中国以 23,233 名作者居首,约为美国 7,556 人的三倍。时间检验奖颁给 ResNet 与 YOLO 两篇 2016 年论文,现场缅怀已故作者孙剑;广工本科生团队凭 Titan 显卡完成的 ChordEdit 获最佳学生论文荣誉提名。
戴盟机器人在 ICRA 2026 上联合银河通用发布含触觉全模态评测基准 RobOmni,其仿真平台基于 NVIDIA Issac Sim 构建,可模拟触觉形变并提供接触力、材质、软硬等信息,并部署真机验证。联合创始人王煜表示,触觉信息必须与手指位置、移动、控制指令精准对齐,否则模型训练会混乱。戴盟同期宣布亿元 A 轮融资,由汇川产投与中国电信联合投资。
速腾聚创在 ICRA 2026 展示面向机器人的全新视觉感知架构,在物理层面实现深度探测与 RGB 天然对齐,无需后期算法校准。副总裁杨先声称该架构基于 SPAD-SoC 数字化架构,可做到几百线甚至上千线,芯片上有两年代差优势,并直接输出深度与图像信息给后端,节省算力、提升帧率、降低延迟。
南洋理工大学刘子纬团队提出 PhysX-Anything,可从单张真实图像生成可直接进入物理引擎的仿真级物理 3D 资产,论文已被 CVPR 2026 收录(arXiv 2511.13648)。
在 ICRA 2026 现场,它石智航首席科学家丁文超接受访谈,把具身智能 2.0 时代的核心特征概括为无本体数据采集和世界动作模型两条主线。它石智航同期展示了 AWE 3.0 模型与首次亮相的 DexHand 灵巧手,后者为 21 自由度准直驱方案,现场演示的线束任务插入精度达到亚毫米级。丁文超表示公司仍在朝百万小时有效数据的目标推进,并聚焦线束柔性装配场景做商业化落地。
ICRA 2026 在维也纳颁出多项核心奖项,胡瑞珍获最佳自动化论文奖,石冠亚获大会最佳论文奖及最佳操作与运动论文奖,王晓龙获 IEEE RAS 青年学术先锋大奖。胡瑞珍团队的 IMR-LLM 用大语言模型实现工业多机器人任务规划与程序生成,石冠亚团队的 OmniRetarget 为人形机器人全身移动操作提供保留物理交互的数据生成范式。
波恩大学教授 Maren Bennewitz 在 ICRA 2026 演讲中提出,机器人需将感知、预测、先验知识与动作规划放入同一闭环,通过主动移动视角、推动或抓取遮挡物,以最少动作获取最多信息。她展示了不确定性语义地图、3D 场景图结合 LLM 语义先验与重定位模型、以及农业监测中基于上一时刻地图先验的非刚性配准三类场景,并指出下一步将学习可见性与遮挡关系图表示。
UC Berkeley 教授 Ken Goldberg 在 ICRA 2026 演讲中提出,机器人领域积累的数据总量远小于大语言模型,存在约十万年的数据鸿沟,因此对数据万能论应保持警惕。
慕尼黑工业大学自动驾驶实验室负责人 Johannes Betz 在 ICRA 2026 演讲中复盘团队过去八九年的自动驾驶赛车研究,其人类启发的主动驾驶智能系统 APEX 在与梅赛德斯-AMG 的测试中比测试车手快 2.6 秒、比前 DTM 车手本·施奈德快 1 秒,但每圈比 F1 车手乔治·拉塞尔慢约 1.5 秒。
AI科技评论的文章认为,Coding 能力正取代参数与月活,成为大模型公司估值的最核心驱动因子。文章以 Anthropic 5 月 28 日完成 650 亿美元 H 轮融资、估值达 9650 亿美元超越 OpenAI 的 8520 亿美元为例,并称仅 Claude Code 一条产品线就单独贡献 25 亿美元 ARR。
上海人工智能实验室提出 AgentDoG 1.5,一套轻量级可扩展的 Agent 安全对齐框架,把轨迹级安全诊断模型部署为在线 guardrail,在最终回复交付前的 Pre-Reply 节点审计完整执行轨迹并拦截风险。
英伟达在 GTC Taipei 发布的 Isaac GR00T 参考人形机器人中,灵巧手来自 Sharpa,本体为宇树 H2 Plus,算力模组为 Jetson Thor。
在 ICRA 2026 的主题演讲中,UT Austin 副教授、NVIDIA GEAR 团队负责人朱玉可提出以三层数据金字塔和世界模型为核心的路径,来缓解人形机器人真实数据稀缺的瓶颈。
银河通用创始人兼 CTO 王鹤在 ICRA 2026 演讲中提出,具身智能正迈向专属的「AlphaGo 时刻」与「ChatGPT 时刻」。他称银河通用已实现完全自主的人形机器人网球对抗和基于「灵巧世界模型」的灵巧手工具操作,并发布结合 VLA 与世界模型的 LDA 模型,已在全家便利店、宁德时代及物流仓储等场景全自主落地。
昆仑万维于 5 月 26 日发布 SkyClaw-v1.0,定价 0.5 元每百万输入 token、4 元每百万输出 token,官方定位为面向工具使用和真实任务执行的 Agent 模型。
香港中文大学(深圳)王方鑫团队联合首都师范大学、南加州大学提出 3DReflecNet,一个面向反射、透明、低纹理物体的 3D 重建数据集,含 12 万+ 合成实例、1000+ 真实物体,总规模超 22 TB。
中国科学院深圳先进技术研究院徐天添在 ICRA 2026 Keynote 演讲中展示了磁控微机器人进展:用柔性霍尔传感器贴片实现便携式三维磁定位,以超声波反馈闭环控制微机器人,并用患者自身血液构建水凝胶微机器人。其磁流体左心耳封堵动物实验中,11 头猪实现完美封堵无渗漏,首头实验猪存活已约两年。
ICRA 2026 于6月1日在奥地利维也纳开幕,有效投稿4947篇、录用1882篇,录用率38.04%,11所中国高校占Top 20的55%。千寻智能在展台展示自研具身基座模型 Spirit v1.6,据现场介绍其在此前盲测中力压英伟达 Cosmos3 与 Physical Intelligence 的 Pi0.5。
新加坡国立大学余浩泳在 ICRA 2026 医疗机器人 keynote 上回顾团队 10 年可穿戴机器人研究,指出外骨骼未被广泛使用的瓶颈是太重、不舒适、穿戴复杂、控制困难且成本高。他提出用单电机加差速机构降低背部、肩部与髋部辅助设备的重量和同步控制难度,并以 FMG 传感器阵列隔衣识别负载等级与任务模式,实现自适应辅助。
Colway(同路 AI)创始人穆建鑫提出 A2H(AI to Human)服务模式,将平台定义为"真人经验增强的个性化服务 Agent",让 AI 连接真实经验而非替代人。Colway 采用积分激励与付费服务结合的轻量化模式,天使轮基本完成,计划今年 9 至 10 月上线,先聚焦国内市场再考虑出海。
2026 年中国图像图形大会(CCIG 2026)5 月 29 日至 31 日在广州举办,由中国图像图形学会主办、中山大学承办,4200 余位专家学者和企业代表参会。
桥介数物创始人尚阳星认为机器人全身运动能力被低估,公司已建成"跨本体全身运动数据工厂",累计产出近千小时高质量 CWM 数据,并在十多款不同足式机器人上完成模型验证。数据工厂采用动捕加第一/第三人称视频采集,配合自研重定向引擎实现跨本体迁移,一小时数据采集成本约几百元,合格率超 90%。桥介计划今年内收集上万小时数据,并于 6 月推出将机器人运动控制做成标准化方案的产品。
上海交通大学教授王贺升在 ICRA 2026 演讲中提出,传统 SLAM 正从静态假设走向动态、可变形环境的具身智能导航。其团队结合激光雷达与视觉多模态融合、动态 Gaussian SLAM 与可变形三维高斯地图,并引入 NeRF 记忆机制和视觉语言模型推理辅助决策,跨模态定位每帧推理仅 14 毫秒。相关技术已在矿卡、仓储机器人、自动泊车和割草机器人等场景落地。
具身智能大脑公司星源智机器人完成新一轮融资,成立10个月累计融资金额达10亿元人民币,资金将用于具身大脑与世界模型研发、产品量产落地及团队扩张。星源智由北京智源研究院孵化,将与智源共同成立"具身交互世界模型实验室",其客户覆盖70%以上头部具身智能公司,并已成为英伟达Jetson Thor平台的全球最大出货商。
千寻智能自研具身基座模型 Spirit v1.6 在 RoboArena 榜单技术全能项目中排名全球第一,超过英伟达 Cosmos 3 与 Physical Intelligence 的 Pi0.5。
橡木果机器人发起人姜峣在访谈中提出以本能驱动替代 VLA 的具身操作路线,公司成立于2024年底,今年3月完成近亿元种子轮融资。其技术路线包含端侧自主决策模型 Natus 与通用操作技能模型 Magis,覆盖定向、探索、抓握三大本能。姜峣称该方案已在某大型化妆品生产线完成 POC 验证并实现营收,已进入量产产线部署阶段。
灵初智能创始人兼CEO王启斌表示,公司自2024年成立起就锚定轮式底盘加双臂的通用灵巧操作路线,认为操作价值远高于移动。今年4月灵初发布策略模型Psi-R2和动作条件型世界模型Psi-W0,Psi-W0训练中加入约30%失败样本,架构基于10万小时人类数据预训练的World Action Model(WAM)。王启斌透露,六七月份将发布基于更大几十万小时数据的模型,今年目标是百万小时级人类数据。
信息工程大学联合中山大学发布RTPSeg数据集,首次将可见光、热红外图像与LiDAR点云三种模态整合用于3D语义分割,并提出多模态融合基线模型RTPSegNet。该模型在昼夜混合场景取得70.07%的mIoU,推理延迟53ms,超越现有LiDAR-only和可见光-LiDAR融合方法。实验验证热红外图像在夜间和复杂光照下对3D感知有显著提升作用。
6月1日,苏度科技在奥地利维也纳开幕的 ICRA 2026 上首次全球公开展示其机器人,现场可准确抓取海绵、塑料瓶、螺丝刀、线束等人类随机摆放的不同材质物体。该机器人采用双臂设计,机械臂拥有7个自由度,夹爪集成多枚摄像头,搭载自研视觉感知系统。公司正构建多样化原子技能体系,现阶段主要面向开发者开放软件能力,最新估值已突破20亿美元。
智象未来开源的文生图模型 HiDream-O1-Image(8B)以 Elo 1187 登顶 Artificial Analysis 开源模型榜,分数力压 Qwen Image(27B)和 FLUX.2 dev,也是该榜前十唯一的开源模型。
前华为天才少年、华为终端云语言大模型技术负责人李一同已加入具身智能公司吉翼智能,出任吉翼大模型研发中心总工程师,主导大模型与系统测试等核心板块。他称2026至2027年吉翼大模型目标是覆盖工业、商业场景95%以上任务,并提升任务精度效率、延长机器人本体寿命、降低制造成本。
Agnes AI 团队把 OpenMythos 的 recurrent-depth 思路移植到约 110M 的 nanowhale / DeepSeek-V4 风格小模型上,在 FineWeb-Edu 10K、5,000 步预训练下,T=1 循环使 held-out PPL 从 baseline 的 166.2 降至 148.3,相对下降约 10.8%,三个随机种子全部获胜。
杭州灵巧手企业黑漫科技完成数千万元新一轮融资,由毅达资本领投,玖兆资本跟投,老股东零一资本持续加注。近6个月公司已连续完成三轮融资,累计融资额近亿元,投资方包括乐聚、东方精工、兆丰股份、申昊科技等产业龙头。本轮资金将用于加速灵巧手量产线建设与工艺优化,并从特种场景向家庭服务、商业服务、工业自动化等市场拓展。
香港中文大学团队提出智能体技能生命周期管理方法 SLIM,在训练中动态保留、退休和扩展外部技能。基于 Qwen3-4B,SLIM 在 ALFWorld 和 SearchQA 上平均超过最佳对比方法 7.1 个百分点,ALFWorld 成功率达 87.5,高于 SkillRL 的 75.0,最终保留 21 个技能。
雷峰网上线「AI 顶会中文内容库」,首批开放 ICRA 与 CVPR 两大顶会专区,提供论文摘要中译、会议日程快讯和开源代码速递,并独家精校汉化 Keynote 与学术大牛 PPT。该内容库还配套 GAIR DAO 的原创 IP 专访与已举办 30 期的 GAIR Live 线上圆桌,ACL、NeurIPS 等专区将陆续解锁。
GAIR Live 第 031 期将于 6 月 1 日晚 19:00 开播,聚焦多模态长记忆落地难题。丘脑智能 CEO 张源与香港科技大学博士研究生任玺谕将围绕「看得准、找得到、想得清」三大环节,拆解压缩与保真的根本矛盾、Embedding 与 Caption 方案的工程问题及跨模态检索的信息稀释难题。任玺谕主导提出了多模态长期记忆评测基准 MEMLENS 和 MMLongBench。
鲲鹏昇腾开发者圆桌上,清华、中科大与AIGCode团队反馈国产算力生态正从「能用」走向「好用易用」:中科大团队迁移异构平台周期从数月缩短至一周左右,新算法平均加速40多倍、部分场景接近200倍;AIGCode在昇腾上完成MoE预训练优化,算力利用率达65%。CANN算子覆盖率约8个月内从不足三成升至80%到90%,昇腾超节点架构下Token开销可降低约50%、沙箱百毫秒级启动。