硬创 Conclave 家庭消费机器人闭门会邀请函:15人聊透商业化真问题
雷峰网硬创邦与山行资本联合发起第3期硬创 Conclave,主题为"家庭消费机器人闭门会——浮生有伴,硅碳共生",定于2026年6月25日14:00-18:00举行,严格限制15人以内。活动聚焦家庭场景刚需真伪、端侧算力与大湾区千元级 BOM 成本博弈、出海专利壁垒与地缘政治三大议题,不直播、不录音、不全文公开。
微信公众号
雷峰网硬创邦与山行资本联合发起第3期硬创 Conclave,主题为"家庭消费机器人闭门会——浮生有伴,硅碳共生",定于2026年6月25日14:00-18:00举行,严格限制15人以内。活动聚焦家庭场景刚需真伪、端侧算力与大湾区千元级 BOM 成本博弈、出海专利壁垒与地缘政治三大议题,不直播、不录音、不全文公开。
OpenRouter 于 6 月 14 日发布 Fusion API,通过最多 8 个专家模型并行、裁判模型挑刺、主笔模型定稿的三步流程,宣称以约一半成本逼近被出口管制的 Claude Fable 5 的智力水平。
世界模型公司 Manifold AI 流形空间近日完成数亿元新一轮融资,Pre-A 轮累计近 10 亿元,成立一年已完成 6 轮融资,跻身独角兽行列。
银河通用创始人王鹤在2026年北京智源大会指出,人形机器人的「AlphaGo」与「ChatGPT」时刻已经到来。银河通用实现全球首个全自主人形机器人打网球,并推出全球首个集成大脑-小脑-神经控制的端到端具身大模型「银河星脑(AstraBrain)」,其WAM 0.5在全部任务上超过π0.5和NVIDIA Groot N1.6。
逻辑智能的 SE-Bridge-TTS 被 ICML 2026 接收,基于 CosyVoice2 底座、从数据层面解决低资源 TTS 的稳定性与表现力矛盾,并公开 Thai / Lao 权重。
九章云极 6 月 17 日正式发布“AI 工厂”核心战略,并推出新一代智算云 Alaya NeW Cloud 3.0,试图以 DCU(1 度算力=312TFLOPS*1 小时)统一算力度量,打通训练工厂到 Token 工厂的专业智能生产链条。平台已累计服务超 3 万次客户算力任务,预置 50 多款主流基座模型,并启动“智算开放计划”拟孵化 1000 个高价值专业模型与智能应用。
Current Robotics 发布人形机器人全身灵巧操作基础系统 Curr-0,通过 Single Policy 将移动控制、全身姿态协调与手部精细操作统一端到端训练,运行在 70+ 自由度人形本体上,单一模型共享权重、全程自主。系统基于 21,000 小时真实人类行为数据训练,其中含 2,800 小时全身示教数据,来自自研 HumanEx 外骨骼采集系统。
物理AI基础设施公司章鱼动力(SynapX)近日完成新一轮5000万美元融资,由锦秋基金、芯联资本和黄浦江资本联合领投,3个月内累计融资接近10亿元人民币。本轮资金将加速推进世界基础模型和"手脑一体"平台研发,计划于2026年下半年发布基础模型并推出核心产品。公司以SYNTH深思架构为核心,聚焦WM2阶段世界模型,并首次提出物理AI五级生产力进阶体系。
大晓机器人官宣完成天使+轮融资,投资方包括深创投、上海科创基金、临港新片区基金、吉利资本、沐曦股份、达晨财智等,老股东商汤国香资本持续增资,四个月累计融资数亿美元。
百奥几何完成数亿元战略融资,其底层模型GeoFlow从2024年6月的V1迭代至V3,V4正在研发,建模尺度从单个分子拓展至细胞水平的分子系统。V2在国际上首先提出用一个模型同时做复合物结构预测和从头生成,V3引入多步推理提升抗体从头设计成功率。其疫苗设计中二聚体比例从天然蛋白不足10%提升至90%以上,冰片酶设计使成本降至植物提取的十分之一。
宾大 GRASP Lab 博士生邵逸飞的研究项目 SymSkill 从最初被拒稿,到拿下 CoRL LEAP Workshop 最佳论文以及 ICRA 2026 大会最佳论文、规划和控制最佳论文双奖。
清华大学季向阳团队提出模型预测任务采样(MPTS),用轻量风险预测模型在线预测任务难度,替代逐个评估的高昂交互成本。该框架已用于具身智能体的鲁棒快速适应,以及推理大模型 RLVR 与 SFT 后训练,代表算法 MoPPS 是最早实现 RLVR 训练加速的预测式采样算法之一。相关成果发表于 Nature Communications、T-PAMI、ICML、KDD、ICLR 等期刊与会议。
穹彻智能副总裁毛崇兆已于日前离职,并于五月末成立"时炉科技",计划面向海外市场推出轮式底盘+单臂形态的家庭场景机器人。毛崇兆曾任穹彻大脑平台研发负责人,此前在非夕科技主导"穹知"系统研发,具身智能研发落地经验近十年。穹彻智能今年2月完成A轮融资,由C资本领投,金额达数亿元人民币。
香港中文大学(深圳)助理教授韩晓光在 CCIG 2026 学生论坛后撰文,探讨什么是好的科研工作。他指出 Oral 提名主要取决于 rebuttal 前的初始分数,完整度高、效果好的论文更易得高分,而有开创性但不完整的工作易成遗珠。他建议年轻研究者回归好奇心驱动,选择更 general 的问题并深入解决困惑,而非被 impact、引用量等模糊指标裹挟。
原力灵机发布具身智能系统 Dexmal Ferrata,通过多智能体协同作业构建具身 Harness,让机器人在有保护前提下进入真实场景长时间作业并持续回流数据。
腾讯混元联合浙大等提出 DepthVLM,仅附加轻量级 DPT-style 深度头,就让标准 VLM 以 𝒪(1) 推理成本原生输出像素级稠密深度图。
乐聚联合蚂蚁灵波完成 LingBot-VLA 具身大模型在 KUAVO 4 Pro 上的后训练适配,并发布后训练系统,基于95个真机操作场景测评,平均成功率 SR 为17.59%,过程得分 PS 为36.22%,比强基线 π0.5 高出9.87个百分点。
百度智能云提出 DAA(Daily Active Agent,日活跃智能体数)作为比 Token 调用量更接近业务价值的衡量指标,AI 与大模型平台总经理忻舟称 Token 是无状态、低粘性的标准化服务,百度因此未跟进亏本卖 Token 的价格战。
北大副教授董豪提出横向二维Scaling Law,在数据量维度外新增任务数量坐标轴,主张用世界模型、生成数据、人类示教串联技术路线,实现机器人"越学越省"。其团队依托世界模型与生成AI,单条真机轨迹可生成50条等效训练数据,并已实现机器人全自主洗衣流程,抓取失败后可主动重试。
围绕 OpenAI 是否终止 IPO 的讨论,核心不在上市本身,而在递归自我改进能否落地为工程闭环。文章认为,AI 系统的价值取决于把真实任务中的失败转化为评估、数据和流程更新的能力,而非单次模型发布。若资金用于建设反馈闭环与验证系统,AI 公司的估值逻辑将从训练规模转向学习速度。
中国科学技术大学与智象未来提出视频超分方法 PS-SR,采用伪单步扩散框架,由 Wan2.1 微调的 base model 单步恢复整体结构,轻量 draft model 细化 3 次并配合频域更新补充高频细节。其推理耗时接近单步方法,细节表现接近多步扩散模型,相比 STAR、SeedVR 速度更快,帧间闪烁更少,适用于真实互联网低质视频增强。
光象科技创始人张涛在访谈中介绍,公司已于6月10日发布工业级自进化具身智能机器人Phi-Bot X1,发布前在ATC展会完成焊接上下料全流程作业,3天持续21.5小时、零失误、成功率100%。他认为90%的公司都在做搬箱子说明场景分析不足,光象把汽车上千个装配工艺拆解成原子动作以逐步落地。他判断训练可用的具身智能最终需要上亿量级数据,而目前公开最大数据集约在百万量级。
美图影像研究院联合北京交通大学提出基于扩散模型的图像属性操纵框架 All-in-One Slider,已被 CVPR 2026 接收。该框架用轻量级属性稀疏自编码器将文本嵌入空间分解为稀疏语义属性方向,训练一次即可作为通用滑块,对年龄、表情、妆容、发型等属性做连续细粒度控制,并支持多属性组合与未见属性的零样本泛化。
在 GAIR Live 圆桌上,MemLens 主导作者任玺谕与丘脑智能 CEO 张源讨论多模态长程记忆为何落地难,认为瓶颈主要在证据写入时的有损压缩和跨模态检索,而非模型推理层。
北京某大厂大模型App立项时曾考虑取名「千问」,最终被大老板否决,不久后阿里「通义千问」横空出世。某手机巨头跟进Claw项目因算力供给不足延期,以OpenClaw为代表的Agent框架算力需求是普通模型的十几倍。某初代国产大模型独角兽陷入内部混乱,核心联创离场,创始人深夜十点查岗质问团队为何不爱工作。
智象未来发布闭源版 HiDream-O1-Image-1.5,在 Artificial Analysis 文生图排名升至第3位,超越 Google 的 Nano Banana 2,仅次于 OpenAI 两款模型,与第二名 GPT-Image 1.5 综合评分差 1 分。
CVPR 2026 共收到 16,092 篇投稿、录用 4,071 篇,录取率 25.3%,5 篇获奖论文中至少 3 篇与具身智能直接相关。视觉-语言与多模态 LLM 论文占比从去年的 4.9% 升至 10.6%,展台上 NVIDIA、Tesla、Apple 分别展示具身智能、纯视觉自动驾驶与视觉基础研究。
仓储具身智能企业韦特嘉机器人(ULTIROBOTICS)完成千万级人民币融资,由常熟经开聚源和深圳科创学院联合投资。其自研 Ulti-Brain 模型通过分层架构与世界模型融合,基于 RGBD 流长时连续空间感知,实现不依赖客户场景数据预先采集的高成功率 zero-shot 分拣。公司产品覆盖人形机器人、无人分拣系统、机器人拣货工作站、库内拣货机器人系统四大方向,目前已完成商业化验证。
清华大学李勇团队提出统一模型 UniCM,用双分支 Transformer 同时学习全球多个气候模态的耦合动力学,将 ENSO 有效预测提前期延长至约 19 个月。
Anthropic 于北京时间 6 月 9 日深夜发布 Claude Fable 5,这是其首款面向普通用户开放的 Mythos 级模型,配备独立安全分类器判断请求是否涉及网络安全、生化研究、模型蒸馏三类高风险领域,触发时请求会被静默路由到 Opus 4.8 回答。
前 DeepMind 蛋白质设计团队核心成员、Latent Labs 创始人兼 CEO Simon Kohl 在 CVPR 2026 发表 Keynote,提出生成式 AI 正推动药物设计从结构预测走向自主智能体。
CVPR 2026 多篇论文聚焦模型在动态真实环境中的适应能力:QKD 用量子门控建模任务相关性做知识蒸馏,缓解类增量学习中的灾难性遗忘;LCA 在 100 万个真实世界单目人物视频上预训练,实现高保真可驱动 3D 数字人。PolyV 采用稀疏 MoE 架构统一图像、视频和 3D,在 10 个基准上相比 Qwen2.5-VL-7B 平均提升约 10%。
哥伦比亚大学助理教授李昀烛在 ICRA 2026 演讲中提出,通用机器人基础模型应走融合 3D 物理先验与海量 2D 数据学习的「中间路线」。其团队用「3D 高斯溅射 + 结构化世界模型」为柔性物体构建数字孪生,仿真与真机成功率呈高度线性相关;另一条路线开发的交互式世界模拟器以 15 帧/秒生成超 10 分钟动作条件视频,纯虚拟数据训练的策略可零样本落地真机,该工作已开源并被 RSS 接收。
自变量机器人开源 XRZero-G0 具身无本体数采系统,包含全身数采、质检、训练与真机评测的完整链路,以及 2000 多小时、覆盖 3000 个任务的多模态无本体数据集。
普渡大学Aniket Bera教授在ICRA 2026演讲中提出“学习负责提议,结构负责决策”框架,主张学习型模块须先通过可被形式化方法验证的“可检查接口”再输出控制指令。其IDEAS实验室的SELP(ICRA 2025最佳论文入围)通过在生成过程中实时屏蔽违反时序逻辑规范的token,让LLM输出天然安全。
vivo BlueImage Lab 提出的图像复原方法 LearnIR 被 ICLR 2026 录用,通过可学习的扩散后验采样框架,无需已知前向退化算子即可完成采样校正。该方法在 O-HAZE 上去雾 PSNR 提升 +2.27 dB,在合成与真实人脸阴影数据上 PSNR 分别提升 +2.44 dB 和 +1.71 dB,仅需 5 步采样、单张 A100 上推理约 1.6 秒。
MIT 副教授 Luca Carlone 在 ICRA 2026 演讲中提出,下一代机器人需要任务驱动的记忆系统,而非一味追求更精确的地图。其团队将 VGGT 子地图对齐中的位姿图优化升级为模型图优化以修正尺度,并构建 3D 场景图、开放词汇场景图 DAAAM 与基于惊喜度的情景记忆路径。后续 Clio 与 Found-IT 支持运行时动态指定任务,实现更轻量的存储。
斯坦福大学 Jeannette Bohg 在 ICRA 2026 演讲中提出,灵巧手的价值在于吞吐量与可控子空间,而非模仿人手。她提出「从物体轨迹学」的路线:先用 UniSim-Real 在仿真中训练单一 RL 策略,让策略追踪物体目标位姿而非人手姿态,实现零样本迁移;再以 Play-to-Effect 微调完成高精度装配。
华为"天才少年"、元石科技早期核心技术成员王裕鑫已创立形界智能,聚焦"流式视频生成",并在成立首月完成数千万级首轮融资。该公司强调视频的实时性与连续交互,目标让视频像"流"一样持续生成并实时响应用户交互,切入实时视频模型、AI 陪伴、互动娱乐与视频 Agent 等场景。王裕鑫曾主导 200B+ 大模型训练,牵头问小白 o4、问小白 5 等项目,其团队曾发布开源并行思考模型 XBai o4。
空间智能与世界模型初创公司知天下(苏州)已完成天使轮融资,由上海众合创投独家投资,探针资本担任财务顾问。资金将用于扩充团队研发生成式高斯基模,并开拓高斯泼溅中国内容社群的海外影响力。知天下专注3DGS三维重建与生成,其平台3DGS创作日均数据已超越英国SuperSplat,仅次于美国World Labs。